Skip to content

Ronald Ortner

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

17

Venues

7

Active years

2004–2023

Best venue rank

A*

Where they publish

Papers

17 indexed papers, newest first.

YearVenueTitleAuthors
2023IJCAIAutonomous Exploration for Navigating in MDPs Using Blackbox RL Algorithms.Pratik Gajane, Peter Auer, Ronald Ortner
2019COLTAchieving Optimal Dynamic Regret for Non-stationary Bandits without Prior Information.Peter Auer, Yifang Chen, Pratik Gajane, Chung-Wei Lee, Haipeng Luo, Ronald Ortner, Chen-Yu Wei
2019COLTAdaptively Tracking the Best Bandit Arm with an Unknown Number of Distribution Changes.Peter Auer, Pratik Gajane, Ronald Ortner
2019UAIVariational Regret Bounds for Reinforcement Learning.Ronald Ortner, Pratik Gajane, Peter Auer
2018ICMLEfficient Bias-Span-Constrained Exploration-Exploitation in Reinforcement Learning.Ronan Fruit, Matteo Pirotta, Alessandro Lazaric, Ronald Ortner
2016AISTATSPareto Front Identification from Stochastic Bandit Feedback.Peter Auer, Chao-Kai Chiang, Ronald Ortner, Madalina M. Drugan
2016AISTATSImproved Learning Complexity in Combinatorial Pure Exploration Bandits.Victor Gabillon, Alessandro Lazaric, Mohammad Ghavamzadeh, Ronald Ortner, Peter L. Bartlett
2015ICMLImproved Regret Bounds for Undiscounted Continuous Reinforcement Learning.K. Lakshmanan, Ronald Ortner, Daniil Ryabko
2014ALTSelecting Near-Optimal Approximate State Representations in Reinforcement Learning.Ronald Ortner, Odalric-Ambrym Maillard, Daniil Ryabko
2013AISTATSCompeting with an Infinite Set of Models in Reinforcement Learning.Phuong Nguyen, Odalric-Ambrym Maillard, Daniil Ryabko, Ronald Ortner
2013ICMLOptimal Regret Bounds for Selecting the State Representation in Reinforcement Learning.Odalric-Ambrym Maillard, Phuong Nguyen, Ronald Ortner, Daniil Ryabko
2012ALTRegret Bounds for Restless Markov Bandits.Ronald Ortner, Daniil Ryabko, Peter Auer, Rmi Munos
2010ICAARTExploiting Similarity Information in Reinforcement Learning - Similarity Models for Multi-Armed Bandits and MDPs.Ronald Ortner
2008ALTOnline Regret Bounds for Markov Decision Processes with Deterministic Transitions.Ronald Ortner
2007ALTPseudometrics for State Aggregation in Average Reward Markov Decision Processes.Ronald Ortner
2007COLTImproved Rates for the Stochastic Continuum-Armed Bandit Problem.Peter Auer, Ronald Ortner, Csaba Szepesvri
2004COLTA New PAC Bound for Intersection-Closed Concept Classes.Peter Auer, Ronald Ortner