Skip to content

Doina Precup

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

142

Venues

28

Active years

1997–2026

Best venue rank

A*

Where they publish

Papers

142 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIBootstrapping Personalized Insulin Therapy via Model-Based Reinforcement Learning: An In Silico Study.Sumana Basu, Flemming Kondrup, Adriana Romero-Soriano, Doina Precup
2025ICLRLangevin Soft Actor-Critic: Efficient Exploration through Uncertainty-Driven Critic Learning.Haque Ishfaq, Guangyuan Wang, Sami Nur Islam, Doina Precup
2025ICLRMaestroMotif: Skill Design from Artificial Intelligence Feedback.Martin Klissarov, Mikael Henaff, Roberta Raileanu, Shagun Sodhani, Pascal Vincent, Amy Zhang, Pierre-Luc Bacon, Doina Precup, Marlos C. Machado, Pierluca D'Oro
2025ICLRTraining Language Models to Self-Correct via Reinforcement Learning.Aviral Kumar, Vincent Zhuang, Rishabh Agarwal, Yi Su, John D. Co-Reyes, Avi Singh, Kate Baumli, Shariq Iqbal, Colton Bishop, Rebecca Roelofs, Lei M. Zhang, Kay McKinney, Disha Shrivastava, Cosmin Paduraru, George Tucker, Doina Precup, Feryal M. P. Behbahani, Aleksandra Faust
2025ICLRSelective Unlearning via Representation Erasure Using Domain Adversarial Training.Nazanin Mohammadi Sepahvand, Eleni Triantafillou, Hugo Larochelle, Doina Precup, James J. Clark, Daniel M. Roy, Gintare Karolina Dziugaite
2025ICMLRejecting Hallucinated State Targets during Planning.Harry Zhao, Tristan Sylvain, Romain Laroche, Doina Precup, Yoshua Bengio
2025ICONIPExcitatory-Inhibitory Dynamics in Adaptive Decision-Making.Veronica Chelu, Doina Precup
2024AISTATSConditions on Preference Relations that Guarantee the Existence of Optimal Policies.Jonathan Colao Carr, Prakash Panangaden, Doina Precup
2024AISTATSOn the Privacy of Selection Mechanisms with Gaussian Noise.Jonathan Lebensold, Doina Precup, Borja Balle
2024AISTATSOn learning history-based policies for controlling Markov decision processes.Gandharv Patil, Aditya Mahajan, Doina Precup
2024ICASSPCryCeleb: A Speaker Verification Dataset Based on Infant Cry Sounds.David Budaghyan, Charles C. Onu, Arsenii Gorin, Cem Subakan, Doina Precup
2024ICLRConsciousness-Inspired Spatio-Temporal Abstractions for Better Generalization in Reinforcement Learning.Harry Zhao, Safa Alver, Harm van Seijen, Romain Laroche, Doina Precup, Yoshua Bengio
2024ICLRProvable and Practical: Efficient Exploration in Reinforcement Learning via Langevin Monte Carlo.Haque Ishfaq, Qingfeng Lan, Pan Xu, A. Rupam Mahmood, Doina Precup, Anima Anandkumar, Kamyar Azizzadenesheli
2024ICMLNash Learning from Human Feedback.Rmi Munos, Michal Valko, Daniele Calandriello, Mohammad Gheshlaghi Azar, Mark Rowland, Daniel Guo, Yunhao Tang, Matthieu Geist, Thomas Mesnard, Cme Fiegel, Andrea Michi, Marco Selvi, Sertan Girgin, Nikola Momchev, Olivier Bachem, Daniel J. Mankowitz, Doina Precup, Bilal Piot
2024ICMLMixtures of Experts Unlock Parameter Scaling for Deep RL.Johan S. Obando-Ceron, Ghada Sokar, Timon Willi, Clare Lyle, Jesse Farebrother, Jakob Nicolaus Foerster, Gintare Karolina Dziugaite, Doina Precup, Pablo Samuel Castro
2024ICMLCode as Reward: Empowering Reinforcement Learning with VLMs.David Venuto, Mohammad Sami Nur Islam, Martin Klissarov, Doina Precup, Sherry Yang, Ankit Anand
2024IJCAIFinding Increasingly Large Extremal Graphs with AlphaZero and Tabu Search.Abbas Mehrabian, Ankit Anand, Hyunjik Kim, Nicolas Sonnerat, Matej Balog, Gheorghe Comanici, Tudor Berariu, Andrew Lee, Anian Ruoss, Anna Bulanova, Daniel Toyama, Sam Blackwell, Bernardino Romera-Paredes, Petar Velickovic, Laurent Orseau, Joonkyung Lee, Anurag Murty Naredla, Doina Precup, Adam Zsolt Wagner
2024UAIDiscrete Probabilistic Inference as Control in Multi-path Environments.Tristan Deleu, Padideh Nouri, Nikolay Malkin, Doina Precup, Yoshua Bengio
2023AAAIOn the Challenges of Using Reinforcement Learning in Precision Drug Dosing: Delay and Prolongedness of Action Effects.Sumana Basu, Marc-Andr Legault, Adriana Romero-Soriano, Doina Precup
2023AAAITowards Safe Mechanical Ventilation Treatment Using Deep Offline Reinforcement Learning.Flemming Kondrup, Thomas Jiralerspong, Elaine Lau, Nathan de Lara, Jacob Shkrob, My Duc Tran, Doina Precup, Sumana Basu
2023AISTATSFinite time analysis of temporal difference learning with linear function approximation: Tail averaging and regularisation.Gandharv Patil, Prashanth L. A., Dheeraj Nagaraj, Doina Precup
2023ICMLMulti-Environment Pretraining Enables Transfer to Action Limited Datasets.David Venuto, Sherry Yang, Pieter Abbeel, Doina Precup, Igor Mordatch, Ofir Nachum
2022ICLRCOptiDICE: Offline Constrained Reinforcement Learning via Stationary Distribution Correction Estimation.Jongmin Lee, Cosmin Paduraru, Daniel J. Mankowitz, Nicolas Heess, Doina Precup, Kee-Eung Kim, Arthur Guez
2022ICLRConstructing a Good Behavior Basis for Transfer using Generalized Policy Updates.Safa Alver, Doina Precup
2022ICLRPolicy Gradients Incorporating the Future.David Venuto, Elaine Lau, Doina Precup, Ofir Nachum
2022ICMLProving Theorems using Incremental Learning and Hindsight Experience Replay.Eser Aygn, Ankit Anand, Laurent Orseau, Xavier Glorot, Stephen Marcus McAleer, Vlad Firoiu, Lei M. Zhang, Doina Precup, Shibl Mourad
2022ICMLWhy Should I Trust You, Bellman? The Bellman Error is a Poor Replacement for Value Error.Scott Fujimoto, David Meger, Doina Precup, Ofir Nachum, Shixiang Shane Gu
2022ICMLImproving Robustness against Real-World and Worst-Case Distribution Shifts through Decision Region Quantification.Leo Schwinn, Leon Bungert, An Nguyen, Ren Raab, Falk Pulsmeyer, Doina Precup, Bjoern M. Eskofier, Dario Zanca
2022IJCAIOn the Expressivity of Markov Reward (Extended Abstract).David Abel, Will Dabney, Anna Harutyunyan, Mark K. Ho, Michael L. Littman, Doina Precup, Satinder Singh
2022UAITowards painless policy optimization for constrained MDPs.Arushi Jain, Sharan Vaswani, Reza Babanezhad, Csaba Szepesvari, Doina Precup
2021AAAIVariance Penalized On-Policy and Off-Policy Actor-Critic.Arushi Jain, Gandharv Patil, Ayush Jain, Khimya Khetarpal, Doina Precup
2021AAAISelf-Supervised Attention-Aware Reinforcement Learning.Haiping Wu, Khimya Khetarpal, Doina Precup
2021ICALPOptimal Spectral-Norm Approximate Minimization of Weighted Finite Automata.Borja Balle, Clara Lacroce, Prakash Panangaden, Doina Precup, Guillaume Rabusseau
2021ICMLLocally Persistent Exploration in Continuous Control Tasks with Sparse Rewards.Susan Amin, Maziar Gomrokchi, Hossein Aboutalebi, Harsh Satija, Doina Precup
2021ICMLPreferential Temporal Difference Learning.Nishanth V. Anand, Doina Precup
2021ICMLA Deep Reinforcement Learning Approach to Marginalized Importance Sampling with the Successor Representation.Scott Fujimoto, David Meger, Doina Precup
2021ICMLRandomized Exploration in Reinforcement Learning with General Value Function Approximation.Haque Ishfaq, Qiwen Cui, Viet Nguyen, Alex Ayoub, Zhuoran Yang, Zhaoran Wang, Doina Precup, Lin Yang
2020AAAIAlgorithmic Improvements for Deep Reinforcement Learning Applied to Interactive Fiction.Vishal Jain, William Fedus, Hugo Larochelle, Doina Precup, Marc G. Bellemare
2020AAAIOptions of Interest: Temporal Abstraction with Interest Functions.Khimya Khetarpal, Martin Klissarov, Maxime Chevalier-Boisvert, Pierre-Luc Bacon, Doina Precup
2020AAAIGifting in Multi-Agent Reinforcement Learning (Student Abstract).Andrei Lupu, Doina Precup
2020AISTATSValue Preserving State-Action Abstractions.David Abel, Nate Umbanhowar, Khimya Khetarpal, Dilip Arumugam, Doina Precup, Michael L. Littman
2020AISTATSA Distributional Analysis of Sampling-Based Reinforcement Learning Algorithms.Philip Amortila, Doina Precup, Prakash Panangaden, Marc G. Bellemare
2020AISTATSEfficient Planning under Partial Observability with Unnormalized Q Functions and Spectral Learning.Tianyu Li, Bogdan Mazoure, Doina Precup, Guillaume Rabusseau
2020CogSciLearning to cooperate: Emergent communication in multi-agent navigation.Ivana Kajic, Eser Aygn, Doina Precup
2020ICMLInvariant Causal Prediction for Block MDPs.Amy Zhang, Clare Lyle, Shagun Sodhani, Angelos Filos, Marta Kwiatkowska, Joelle Pineau, Yarin Gal, Doina Precup
2020ICMLInterference and Generalization in Temporal Difference Learning.Emmanuel Bengio, Joelle Pineau, Doina Precup
2020ICMLWhat can I do here? A Theory of Affordances in Reinforcement Learning.Khimya Khetarpal, Zafarali Ahmed, Gheorghe Comanici, David Abel, Doina Precup
2020IJCAISVRG for Policy Evaluation with Fewer Gradient Evaluations.Zilun Peng, Ahmed Touati, Pascal Vincent, Doina Precup
2019AAAITemporally Extended Metrics for Markov Decision Processes.Philip Amortila, Marc G. Bellemare, Prakash Panangaden, Doina Precup
2019AAAICombined Reinforcement Learning via Abstract Representations.Vincent Franois-Lavet, Yoshua Bengio, Doina Precup, Joelle Pineau
2019AAAILearning Options with Interest Functions.Khimya Khetarpal, Doina Precup
2019AAAILeveraging Observations in Bandits: Between Risks and Benefits.Andrei Lupu, Audrey Durand, Doina Precup
2019AISTATSThe Termination Critic.Anna Harutyunyan, Will Dabney, Diana Borsa, Nicolas Heess, Rmi Munos, Doina Precup
2019AISTATSConnecting Weighted Automata and Recurrent Neural Networks through Spectral Learning.Guillaume Rabusseau, Tianyu Li, Doina Precup
2019CoRLNavigation Agents for the Visually Impaired: A Sidewalk Simulator and Experiments.Martin Weiss, Simon Chamorro, Roger Girgis, Margaux Luck, Samira Ebrahimi Kahou, Joseph Paul Cohen, Derek Nowrouzezahrai, Doina Precup, Florian Golemo, Chris Pal
2019ICLRLearning proposals for sequential importance samplers using reinforced variational inference.Zafarali Ahmed, Arjun Karuvally, Doina Precup, Simon Gravel
2019ICMLOff-Policy Deep Reinforcement Learning without Exploration.Scott Fujimoto, David Meger, Doina Precup
2019ICMLPer-Decision Option Discounting.Anna Harutyunyan, Peter Vrancx, Philippe Hamel, Ann Now, Doina Precup
2019IJCAILearning Modular Safe Policies in the Bandit Setting with Application to Adaptive Clinical Trials.Hossein Aboutalebi, Doina Precup, Tibor Schuster
2019IJCAILearning Reliable Policies in the Bandit Setting with Application to Adaptive Clinical Trials.Hossein Aboutalebi, Doina Precup, Tibor Schuster
2019InterspeechNeural Transfer Learning for Cry-Based Diagnosis of Perinatal Asphyxia.Charles C. Onu, Jonathan Lebensold, William L. Hamilton, Doina Precup
2019ICRAUncertainty Aware Learning from Demonstrations in Multiple Contexts using Bayesian Neural Networks.Sanjay Thakur, Herke van Hoof, Juan Camilo Gamboa Higuera, Doina Precup, David Meger
2019MICCAIEarly Prediction of Alzheimer's Disease Progression Using Variational Autoencoders.Sumana Basu, Konrad Wagstyl, Azar Zandifar, D. Louis Collins, Adriana Romero, Doina Precup
2019MICCAIImproving Pathological Structure Segmentation via Transfer Learning Across Diseases.Barleen Kaur, Paul Lematre, Raghav Mehta, Nazanin Mohammadi Sepahvand, Doina Precup, Douglas L. Arnold, Tal Arbel
2018AAAIOptionGAN: Learning Joint Reward-Policy Options Using Generative Adversarial Inverse Reinforcement Learning.Peter Henderson, Wei-Di Chang, Pierre-Luc Bacon, David Meger, Joelle Pineau, Doina Precup
2018AAAIDeep Reinforcement Learning That Matters.Peter Henderson, Riashat Islam, Philip Bachman, Joelle Pineau, Doina Precup, David Meger
2018AAAILearning Predictive State Representations From Non-Uniform Sampling.Yuri Grinberg, Hossein Aboutalebi, Melanie Lyman-Abramovitch, Borja Balle, Doina Precup
2018AAAIWhen Waiting Is Not an Option: Learning Options With a Deliberation Cost.Jean Harb, Pierre-Luc Bacon, Martin Klissarov, Doina Precup
2018AAAILearning With Options That Terminate Off-Policy.Anna Harutyunyan, Peter Vrancx, Pierre-Luc Bacon, Doina Precup, Ann Now
2018AAAIImitation Upper Confidence Bound for Bandits on a Graph.Andrei Lupu, Doina Precup
2018AAAILearning Robust Options.Daniel J. Mankowitz, Timothy A. Mann, Pierre-Luc Bacon, Doina Precup, Shie Mannor
2018AISTATSNonlinear Weighted Finite Automata.Tianyu Li, Guillaume Rabusseau, Doina Precup
2018ICMLConvergent TREE BACKUP and RETRACE with Function Approximation.Ahmed Touati, Pierre-Luc Bacon, Doina Precup, Pascal Vincent
2018MICCAIExploring Uncertainty Measures in Deep Networks for Multiple Sclerosis Lesion Detection and Segmentation.Tanya Nair, Doina Precup, Douglas L. Arnold, Tal Arbel
2017AAAIThe Option-Critic Architecture.Pierre-Luc Bacon, Jean Harb, Doina Precup
2017AAAIReal-Time Indoor Localization in Smart Homes Using Semi-Supervised Learning.Negar Ghourchian, Michel Allegue-Martnez, Doina Precup
2017EMNLPWorld Knowledge for Reading Comprehension: Rare Entity Prediction with Hierarchical LSTMs Using External Descriptions.Teng Long, Emmanuel Bengio, Ryan Lowe, Jackie Chi Kit Cheung, Doina Precup
2017IJCAIApproximate Value Iteration with Temporally Extended Actions (Extended Abstract).Timothy A. Mann, Shie Mannor, Doina Precup
2017MICCAIPredicting Future Disease Activity and Treatment Responders for Multiple Sclerosis Patients Using a Bag-of-Lesions Brain Representation.Andrew Doyle, Doina Precup, Douglas L. Arnold, Tal Arbel
2016AAAIIncremental Stochastic Factorization for Online Reinforcement Learning.Andr da Motta Salles Barreto, Rafael L. Beirigo, Joelle Pineau, Doina Precup
2016ACLLeveraging Lexical Resources for Learning Entity Embeddings in Multi-Relational Data.Teng Long, Ryan Lowe, Jackie Chi Kit Cheung, Doina Precup
2016EMNLPVerb Phrase Ellipsis Resolution Using Discriminative and Margin-Infused Algorithms.Kian Kenyon-Dean, Jackie Chi Kit Cheung, Doina Precup
2016ICMLDifferentially Private Policy Evaluation.Borja Balle, Maziar Gomrokchi, Doina Precup
2016IJCAILearning Multi-Step Predictive State Representations.Lucas Langer, Borja Balle, Doina Precup
2015AAAIRepresentation Discovery for MDPs Using Bisimulation Metrics.Sherry Shanshan Ruan, Gheorghe Comanici, Prakash Panangaden, Doina Precup
2015AAAIRepresentation Discovery for MDPs Using Bisimulation Metrics.Sherry Shanshan Ruan, Gheorghe Comanici, Prakash Panangaden, Doina Precup
2015ICMLVariational Generative Stochastic Networks with Collaborative Shaping.Philip Bachman, Doina Precup
2015IJCAIAn Expectation-Maximization Algorithm to Compute a Stochastic Factorization From Data.Andr da Motta Salles Barreto, Rafael L. Beirigo, Joelle Pineau, Doina Precup
2015LICSA Canonical Form for Weighted Automata and Applications to Approximate Minimization.Borja Balle, Prakash Panangaden, Doina Precup
2015UAILearning and Planning with Timing Information in Markov Decision Processes.Pierre-Luc Bacon, Borja Balle, Doina Precup
2014AIAnalyzing User Trajectories from Mobile Device Data with Hierarchical Dirichlet Processes.Negar Ghourchian, Doina Precup
2014CVPRIterative Multilevel MRF Leveraging Context and Voxel Information for Brain Tumour Segmentation in MRI.Nagesh K. Subbanna, Doina Precup, Tal Arbel
2014ECCVProbabilistic Temporal Head Pose Estimation Using a Hierarchical Graphical Model.Meltem Demirkus, Doina Precup, James J. Clark, Tal Arbel
2014ICIPMulti-layer temporal graphical model for head pose estimation in real-world videos.Meltem Demirkus, Doina Precup, James J. Clark, Tal Arbel
2014ICMLSample-based approximate regularization.Philip Bachman, Amir-massoud Farahmand, Doina Precup
2014ICMLA new Q(lambda) with interim forward view and Monte Carlo equivalence.Richard S. Sutton, Ashique Rupam Mahmood, Doina Precup, Hado van Hasselt
2014UAIBisimulation Metrics are Optimal Value Functions.Norman Ferns, Doina Precup
2013AMIAUsing Hierarchical Mixture of Experts Model for Fusion of Outbreak Detection Methods.Nastaran Jafarpour, Doina Precup, Masoumeh T. Izadi, David L. Buckeridge
2013IAAIAssessing the Predictability of Hospital Readmission Using Machine Learning.Arian Hosseinzadeh, Masoumeh T. Izadi, Aman Verma, Doina Precup, David L. Buckeridge
2013ICMLAverage Reward Optimization Objective In Partially Observable Domains.Yuri Grinberg, Doina Precup
2013ICPRAMSmart Classifier Selection for Activity Recognition on Wearable Devices.Negar Ghourchian, Doina Precup
2013MICCAIHierarchical Probabilistic Gabor and MRF Segmentation of Brain Tumours in MRI Volumes.Nagesh K. Subbanna, Doina Precup, D. Louis Collins, Tal Arbel
2012AAAICompressed Least-Squares Regression on Sparse Spaces.Mahdi Milani Fard, Yuri Grinberg, Joelle Pineau, Doina Precup
2012AIMining Administrative Data to Predict Falls in the Elderly Population.Arian Hosseinzadeh, Masoumeh T. Izadi, Doina Precup, David L. Buckeridge
2012CVPRSoft biometric trait classification from real-world face videos conditioned on head pose estimation.Meltem Demirkus, Doina Precup, James J. Clark, Tal Arbel
2012ICMLImproved Estimation in Time Varying Models.Doina Precup, Philip Bachman
2011AAAILearning Compact Representations of Time-Varying Processes.Philip Bachman, Doina Precup
2011AAAIBasis Function Discovery Using Spectral Clustering and Bisimulation Metrics.Gheorghe Comanici, Doina Precup
2010AAAIUsing Bisimulation for Policy Transfer in MDPs.Pablo Samuel Castro, Doina Precup
2010AAAIActivity and Gait Recognition with Time-Delay Embeddings.Jordan Frank, Shie Mannor, Doina Precup
2010CIKMAutomatically suggesting topics for augmenting text documents.Robert West, Doina Precup, Joelle Pineau
2010IAAIA Machine Learning Approach to the Detection of Fetal Hypoxia during Labor and Delivery.Philip A. Warrick, Emily F. Hamilton, Robert E. Kearney, Doina Precup
2010ICMLApproximate Predictive Representations of Partially Observable Systems.Monica Dinculescu, Doina Precup
2009CIKMCompleting wikipedia's hyperlink structure through dimensionality reduction.Robert West, Doina Precup, Joelle Pineau
2009ICMLFast gradient-descent methods for temporal-difference learning with linear function approximation.Richard S. Sutton, Hamid Reza Maei, Doina Precup, Shalabh Bhatnagar, David Silver, Csaba Szepesvri, Eric Wiewiora
2009IJCAIEquivalence Relations in Fully and Partially Observable Markov Decision Processes.Pablo Samuel Castro, Prakash Panangaden, Doina Precup
2009IJCAIWikispeedia: An Online Game for Inferring Semantic Distances between Concepts.Robert West, Joelle Pineau, Doina Precup
2008AIPoint-Based Planning for Predictive State Representations.Masoumeh T. Izadi, Doina Precup
2008ICMLReinforcement learning in the presence of rare events.Jordan Frank, Shie Mannor, Doina Precup
2007IJCAIContext-Driven Predictions.Marc G. Bellemare, Doina Precup
2007IJCAIFast Image Alignment Using Anytime Algorithms.Rupert Brooks, Tal Arbel, Doina Precup
2007IJCAIUsing Linear Programming for Bayesian Exploration in Markov Decision Processes.Pablo Samuel Castro, Doina Precup
2007ICRAA formal framework for robot learning and control under model uncertainty.Robin Jaulmes, Joelle Pineau, Doina Precup
2006AAAIRepresenting Systems with Hidden State.Christopher Hundt, Prakash Panangaden, Joelle Pineau, Doina Precup
2006AIBelief Selection in Point-Based Planning Algorithms for POMDPs.Masoumeh T. Izadi, Doina Precup, Danielle Azar
2006ICMLAutomatic basis function construction for approximate dynamic programming and reinforcement learning.Philipp W. Keller, Shie Mannor, Doina Precup
2006PAKDDData Mining Using Relational Database Management Systems.Beibei Zou, Xuesong Ma, Bettina Kemme, Glen Newton, Doina Precup
2006UAIMethods for Computing State Similarity in Markov Decision Processes.Norm Ferns, Pablo Samuel Castro, Doina Precup, Prakash Panangaden
2005IJCAIModel minimization by linear PSR.Masoumeh T. Izadi, Doina Precup
2005IJCAIUsing core beliefs for point-based value iteration.Masoumeh T. Izadi, Ajit V. Rajwade, Doina Precup
2005UAIMetrics for Markov Decision Processes with Infinite State Spaces.Norm Ferns, Prakash Panangaden, Doina Precup
2004AAAIMetrics for Finite Markov Decision Processes.Norm Ferns, Prakash Panangaden, Doina Precup
2004UAIMetrics for Finite Markov Decision Processes.Norm Ferns, Prakash Panangaden, Doina Precup
2003ICMLCombining TD-learning with Cascade-correlation Networks.Franois Rivest, Doina Precup
2003IJCAIA Planning Algorithm for Predictive State Representations.Masoumeh T. Izadi, Doina Precup
2001ICMLOff-Policy Temporal Difference Learning with Function Approximation.Doina Precup, Richard S. Sutton, Sanjoy Dasgupta
2001ICTAIDeveloping Collaborative Golog Agents by Reinforcement Learning.Ioan Alfred Letia, Doina Precup
2000ICMLEligibility Traces for Off-Policy Policy Evaluation.Doina Precup, Richard S. Sutton, Satinder Singh
1998ICMLClassification Using Phi-Machines and Constructive Function Approximation.Doina Precup, Paul E. Utgoff
1998ICMLIntra-Option Learning about Temporally Abstract Actions.Richard S. Sutton, Doina Precup, Satinder Singh
1997ICMLExponentiated Gradient Methods for Reinforcement Learning.Doina Precup, Richard S. Sutton
1997IDAHow to Find Big-Oh in Your Data Set (and How Not to).Catherine C. McGeoch, Doina Precup, Paul R. Cohen