| 2023 | IJCAI | Autonomous Exploration for Navigating in MDPs Using Blackbox RL Algorithms. | Pratik Gajane, Peter Auer, Ronald Ortner |
| 2019 | COLT | Achieving Optimal Dynamic Regret for Non-stationary Bandits without Prior Information. | Peter Auer, Yifang Chen, Pratik Gajane, Chung-Wei Lee, Haipeng Luo, Ronald Ortner, Chen-Yu Wei |
| 2019 | COLT | Adaptively Tracking the Best Bandit Arm with an Unknown Number of Distribution Changes. | Peter Auer, Pratik Gajane, Ronald Ortner |
| 2019 | UAI | Variational Regret Bounds for Reinforcement Learning. | Ronald Ortner, Pratik Gajane, Peter Auer |
| 2018 | ICML | Efficient Bias-Span-Constrained Exploration-Exploitation in Reinforcement Learning. | Ronan Fruit, Matteo Pirotta, Alessandro Lazaric, Ronald Ortner |
| 2016 | AISTATS | Pareto Front Identification from Stochastic Bandit Feedback. | Peter Auer, Chao-Kai Chiang, Ronald Ortner, Madalina M. Drugan |
| 2016 | AISTATS | Improved Learning Complexity in Combinatorial Pure Exploration Bandits. | Victor Gabillon, Alessandro Lazaric, Mohammad Ghavamzadeh, Ronald Ortner, Peter L. Bartlett |
| 2015 | ICML | Improved Regret Bounds for Undiscounted Continuous Reinforcement Learning. | K. Lakshmanan, Ronald Ortner, Daniil Ryabko |
| 2014 | ALT | Selecting Near-Optimal Approximate State Representations in Reinforcement Learning. | Ronald Ortner, Odalric-Ambrym Maillard, Daniil Ryabko |
| 2013 | AISTATS | Competing with an Infinite Set of Models in Reinforcement Learning. | Phuong Nguyen, Odalric-Ambrym Maillard, Daniil Ryabko, Ronald Ortner |
| 2013 | ICML | Optimal Regret Bounds for Selecting the State Representation in Reinforcement Learning. | Odalric-Ambrym Maillard, Phuong Nguyen, Ronald Ortner, Daniil Ryabko |
| 2012 | ALT | Regret Bounds for Restless Markov Bandits. | Ronald Ortner, Daniil Ryabko, Peter Auer, Rmi Munos |
| 2010 | ICAART | Exploiting Similarity Information in Reinforcement Learning - Similarity Models for Multi-Armed Bandits and MDPs. | Ronald Ortner |
| 2008 | ALT | Online Regret Bounds for Markov Decision Processes with Deterministic Transitions. | Ronald Ortner |
| 2007 | ALT | Pseudometrics for State Aggregation in Average Reward Markov Decision Processes. | Ronald Ortner |
| 2007 | COLT | Improved Rates for the Stochastic Continuum-Armed Bandit Problem. | Peter Auer, Ronald Ortner, Csaba Szepesvri |
| 2004 | COLT | A New PAC Bound for Intersection-Closed Concept Classes. | Peter Auer, Ronald Ortner |