Skip to content

Ian Osband

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

12

Venues

4

Active years

2016–2023

Best venue rank

A*

Where they publish

Papers

12 indexed papers, newest first.

YearVenueTitleAuthors
2023UAIApproximate Thompson Sampling via Epistemic Neural Networks.Ian Osband, Zheng Wen, Seyed Mohammad Asghari, Vikranth Dwaracherla, Morteza Ibrahimi, Xiuyuan Lu, Benjamin Van Roy
2022UAIEvaluating high-order predictive distributions in deep learning.Ian Osband, Zheng Wen, Seyed Mohammad Asghari, Vikranth Dwaracherla, Xiuyuan Lu, Benjamin Van Roy
2021UAIMatrix games with bandit feedback.Brendan O'Donoghue, Tor Lattimore, Ian Osband
2020ICLRHypermodels for Exploration.Vikranth Dwaracherla, Xiuyuan Lu, Morteza Ibrahimi, Ian Osband, Zheng Wen, Benjamin Van Roy
2020ICLRMaking Sense of Reinforcement Learning and Probabilistic Inference.Brendan O'Donoghue, Ian Osband, Catalin Ionescu
2020ICLRBehaviour Suite for Reinforcement Learning.Ian Osband, Yotam Doron, Matteo Hessel, John Aslanides, Eren Sezener, Andre Saraiva, Katrina McKinney, Tor Lattimore, Csaba Szepesvri, Satinder Singh, Benjamin Van Roy, Richard S. Sutton, David Silver, Hado van Hasselt
2018AAAIDeep Q-learning From Demonstrations.Todd Hester, Matej Vecerk, Olivier Pietquin, Marc Lanctot, Tom Schaul, Bilal Piot, Dan Horgan, John Quan, Andrew Sendonaris, Ian Osband, Gabriel Dulac-Arnold, John P. Agapiou, Joel Z. Leibo, Audrunas Gruslys
2018ICLRNoisy Networks For Exploration.Meire Fortunato, Mohammad Gheshlaghi Azar, Bilal Piot, Jacob Menick, Matteo Hessel, Ian Osband, Alex Graves, Volodymyr Mnih, Rmi Munos, Demis Hassabis, Olivier Pietquin, Charles Blundell, Shane Legg
2018ICMLThe Uncertainty Bellman Equation and Exploration.Brendan O'Donoghue, Ian Osband, Rmi Munos, Volodymyr Mnih
2017ICMLMinimax Regret Bounds for Reinforcement Learning.Mohammad Gheshlaghi Azar, Ian Osband, Rmi Munos
2017ICMLWhy is Posterior Sampling Better than Optimism for Reinforcement Learning?Ian Osband, Benjamin Van Roy
2016ICMLGeneralization and Exploration via Randomized Value Functions.Ian Osband, Benjamin Van Roy, Zheng Wen