| 2026 | AAAI | Convergence of Fast Policy Iteration in Markov Games and Robust MDPs. | Keith Badger, Jefferson Huang, Marek Petrik |
| 2025 | AAAI | Risk-averse Total-reward MDPs with ERM and EVaR. | Xihong Su, Marek Petrik, Julien Grand-Clment |
| 2025 | AISTATS | Q-learning for Quantile MDPs: A Decomposition, Performance, and Convergence Analysis. | Jia Lin Hau, Erick Delage, Esther Derman, Mohammad Ghavamzadeh, Marek Petrik |
| 2025 | ICML | Provable Policy Gradient for Robust Average-Reward MDPs Beyond Rectangularity. | Qiuhao Wang, Yuqi Zha, Chin Pang Ho, Marek Petrik |
| 2024 | ICML | Bayesian Regret Minimization in Offline Bandits. | Marek Petrik, Guy Tennenholtz, Mohammad Ghavamzadeh |
| 2023 | AISTATS | Entropic Risk Optimization in Discounted MDPs. | Jia Lin Hau, Marek Petrik, Mohammad Ghavamzadeh |
| 2023 | ICML | Policy Gradient in Robust MDPs with Global Convergence Guarantee. | Qiuhao Wang, Chin Pang Ho, Marek Petrik |
| 2023 | UAI | Solving multi-model MDPs by coordinate ascent and dynamic programming. | Xihong Su, Marek Petrik |
| 2022 | UAI | Data poisoning attacks on off-policy policy evaluation methods. | Elita A. Lobo, Harvineet Singh, Marek Petrik, Cynthia Rudin, Himabindu Lakkaraju |
| 2021 | AISTATS | Optimizing Percentile Criterion using Robust MDPs. | Bahram Behzadian, Reazul Hasan Russel, Marek Petrik, Chin Pang Ho |
| 2021 | ICML | Policy Gradient Bayesian Robust Optimization for Imitation Learning. | Zaynah Javed, Daniel S. Brown, Satvik Sharma, Jerry Zhu, Ashwin Balakrishna, Marek Petrik, Anca D. Dragan, Ken Goldberg |
| 2021 | IROS | Robust Behavior Cloning with Adversarial Demonstration Detection. | Mostafa Hussein, Brendan Crowe, Madison Clark-Turner, Paul Gesel, Marek Petrik, Momotaz Begum |
| 2020 | AAAI | Beliefs We Can Believe in: Replacing Assumptions with Data in Real-Time Search. | Maximilian Fickert, Tianyi Gu, Leonhard Staut, Wheeler Ruml, Jrg Hoffmann, Marek Petrik |
| 2019 | AAAI | Real-Time Planning as Decision-Making under Uncertainty. | Andrew Mitchell, Wheeler Ruml, Fabian Spaniol, Jrg Hoffmann, Marek Petrik |
| 2019 | ICRA | Inverse Reinforcement Learning of Interaction Dynamics from Demonstrations. | Mostafa Hussein, Momotaz Begum, Marek Petrik |
| 2018 | ICML | Fast Bellman Updates for Robust MDPs. | Chin Pang Ho, Marek Petrik, Wolfram Wiesemann |
| 2018 | ISAIM | Low-rank Feature Selection for Reinforcement Learning. | Bahram Behzadian, Marek Petrik |
| 2017 | AAAI | Robust Partially-Compressed Least-Squares. | Stephen Becker, Ban Kawas, Marek Petrik |
| 2017 | UAI | Value Directed Exploration in Multi-Armed Bandits with Structured Priors. | Bence Cserna, Marek Petrik, Reazul Hasan Russel, Wheeler Ruml |
| 2017 | UAI | A Practical Method for Solving Contextual Bandit Problems Using Decision Trees. | Adam N. Elmachtoub, Ryan McNellis, Sechan Oh, Marek Petrik |
| 2016 | IJCAI | Proximal Gradient Temporal Difference Learning Algorithms. | Bo Liu, Ji Liu, Mohammad Ghavamzadeh, Sridhar Mahadevan, Marek Petrik |
| 2016 | UAI | Interpretable Policies for Dynamic Product Recommendations. | Marek Petrik, Ronny Luss |
| 2015 | UAI | Finite-Sample Analysis of Proximal Gradient TD Algorithms. | Bo Liu, Ji Liu, Mohammad Ghavamzadeh, Sridhar Mahadevan, Marek Petrik |
| 2015 | UAI | Optimal Threshold Control for Energy Arbitrage with Degradable Battery Storage. | Marek Petrik, Xiaojian Wu |
| 2013 | WSC | Agile logistics simulation and optimization for managing disaster responses. | Francisco Barahona, Markus Ettl, Marek Petrik, Peter M. Rimshnick |
| 2013 | UAI | Solution Methods for Constrained Markov Decision Process with Continuous Probability Modulation. | Marek Petrik, Dharmashankar Subramanian, Janusz Marecki |
| 2012 | ICML | Approximate Dynamic Programming By Minimizing Distributionally Robust Bounds. | Marek Petrik |
| 2012 | UAI | An Approximate Solution Method for Large Risk-Averse Markov Decision Processes. | Marek Petrik, Dharmashankar Subramanian |
| 2011 | AAAI | Linear Dynamic Programs for Resource Management. | Marek Petrik, Shlomo Zilberstein |
| 2010 | ICML | Feature Selection Using Regularization in Approximate Linear Programs for Markov Decision Processes. | Marek Petrik, Gavin Taylor, Ronald Parr, Shlomo Zilberstein |
| 2009 | ICML | Constraint relaxation in approximate linear programs. | Marek Petrik, Shlomo Zilberstein |
| 2008 | AAAI | Interaction Structure and Dimensionality Reduction in Decentralized MDPs. | Martin Allen, Marek Petrik, Shlomo Zilberstein |
| 2008 | ISAIM | A Successive Approximation Algorithm for Coordination Problems. | Marek Petrik, Shlomo Zilberstein |
| 2007 | AAAI | Anytime Coordination Using Separable Bilinear Programs. | Marek Petrik, Shlomo Zilberstein |
| 2007 | IJCAI | An Analysis of Laplacian Methods for Value Function Approximation in MDPs. | Marek Petrik |
| 2007 | IJCAI | Average-Reward Decentralized Markov Decision Processes. | Marek Petrik, Shlomo Zilberstein |
| 2006 | ISAIM | Learning Static Parallel Portfolios of Algorithms. | Marek Petrik, Shlomo Zilberstein |