Skip to content

Marek Petrik

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

37

Venues

9

Active years

2006–2026

Best venue rank

A*

Where they publish

Papers

37 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIConvergence of Fast Policy Iteration in Markov Games and Robust MDPs.Keith Badger, Jefferson Huang, Marek Petrik
2025AAAIRisk-averse Total-reward MDPs with ERM and EVaR.Xihong Su, Marek Petrik, Julien Grand-Clment
2025AISTATSQ-learning for Quantile MDPs: A Decomposition, Performance, and Convergence Analysis.Jia Lin Hau, Erick Delage, Esther Derman, Mohammad Ghavamzadeh, Marek Petrik
2025ICMLProvable Policy Gradient for Robust Average-Reward MDPs Beyond Rectangularity.Qiuhao Wang, Yuqi Zha, Chin Pang Ho, Marek Petrik
2024ICMLBayesian Regret Minimization in Offline Bandits.Marek Petrik, Guy Tennenholtz, Mohammad Ghavamzadeh
2023AISTATSEntropic Risk Optimization in Discounted MDPs.Jia Lin Hau, Marek Petrik, Mohammad Ghavamzadeh
2023ICMLPolicy Gradient in Robust MDPs with Global Convergence Guarantee.Qiuhao Wang, Chin Pang Ho, Marek Petrik
2023UAISolving multi-model MDPs by coordinate ascent and dynamic programming.Xihong Su, Marek Petrik
2022UAIData poisoning attacks on off-policy policy evaluation methods.Elita A. Lobo, Harvineet Singh, Marek Petrik, Cynthia Rudin, Himabindu Lakkaraju
2021AISTATSOptimizing Percentile Criterion using Robust MDPs.Bahram Behzadian, Reazul Hasan Russel, Marek Petrik, Chin Pang Ho
2021ICMLPolicy Gradient Bayesian Robust Optimization for Imitation Learning.Zaynah Javed, Daniel S. Brown, Satvik Sharma, Jerry Zhu, Ashwin Balakrishna, Marek Petrik, Anca D. Dragan, Ken Goldberg
2021IROSRobust Behavior Cloning with Adversarial Demonstration Detection.Mostafa Hussein, Brendan Crowe, Madison Clark-Turner, Paul Gesel, Marek Petrik, Momotaz Begum
2020AAAIBeliefs We Can Believe in: Replacing Assumptions with Data in Real-Time Search.Maximilian Fickert, Tianyi Gu, Leonhard Staut, Wheeler Ruml, Jrg Hoffmann, Marek Petrik
2019AAAIReal-Time Planning as Decision-Making under Uncertainty.Andrew Mitchell, Wheeler Ruml, Fabian Spaniol, Jrg Hoffmann, Marek Petrik
2019ICRAInverse Reinforcement Learning of Interaction Dynamics from Demonstrations.Mostafa Hussein, Momotaz Begum, Marek Petrik
2018ICMLFast Bellman Updates for Robust MDPs.Chin Pang Ho, Marek Petrik, Wolfram Wiesemann
2018ISAIMLow-rank Feature Selection for Reinforcement Learning.Bahram Behzadian, Marek Petrik
2017AAAIRobust Partially-Compressed Least-Squares.Stephen Becker, Ban Kawas, Marek Petrik
2017UAIValue Directed Exploration in Multi-Armed Bandits with Structured Priors.Bence Cserna, Marek Petrik, Reazul Hasan Russel, Wheeler Ruml
2017UAIA Practical Method for Solving Contextual Bandit Problems Using Decision Trees.Adam N. Elmachtoub, Ryan McNellis, Sechan Oh, Marek Petrik
2016IJCAIProximal Gradient Temporal Difference Learning Algorithms.Bo Liu, Ji Liu, Mohammad Ghavamzadeh, Sridhar Mahadevan, Marek Petrik
2016UAIInterpretable Policies for Dynamic Product Recommendations.Marek Petrik, Ronny Luss
2015UAIFinite-Sample Analysis of Proximal Gradient TD Algorithms.Bo Liu, Ji Liu, Mohammad Ghavamzadeh, Sridhar Mahadevan, Marek Petrik
2015UAIOptimal Threshold Control for Energy Arbitrage with Degradable Battery Storage.Marek Petrik, Xiaojian Wu
2013WSCAgile logistics simulation and optimization for managing disaster responses.Francisco Barahona, Markus Ettl, Marek Petrik, Peter M. Rimshnick
2013UAISolution Methods for Constrained Markov Decision Process with Continuous Probability Modulation.Marek Petrik, Dharmashankar Subramanian, Janusz Marecki
2012ICMLApproximate Dynamic Programming By Minimizing Distributionally Robust Bounds.Marek Petrik
2012UAIAn Approximate Solution Method for Large Risk-Averse Markov Decision Processes.Marek Petrik, Dharmashankar Subramanian
2011AAAILinear Dynamic Programs for Resource Management.Marek Petrik, Shlomo Zilberstein
2010ICMLFeature Selection Using Regularization in Approximate Linear Programs for Markov Decision Processes.Marek Petrik, Gavin Taylor, Ronald Parr, Shlomo Zilberstein
2009ICMLConstraint relaxation in approximate linear programs.Marek Petrik, Shlomo Zilberstein
2008AAAIInteraction Structure and Dimensionality Reduction in Decentralized MDPs.Martin Allen, Marek Petrik, Shlomo Zilberstein
2008ISAIMA Successive Approximation Algorithm for Coordination Problems.Marek Petrik, Shlomo Zilberstein
2007AAAIAnytime Coordination Using Separable Bilinear Programs.Marek Petrik, Shlomo Zilberstein
2007IJCAIAn Analysis of Laplacian Methods for Value Function Approximation in MDPs.Marek Petrik
2007IJCAIAverage-Reward Decentralized Markov Decision Processes.Marek Petrik, Shlomo Zilberstein
2006ISAIMLearning Static Parallel Portfolios of Algorithms.Marek Petrik, Shlomo Zilberstein