Skip to content

David Silver

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

50

Venues

10

Active years

2003–2022

Best venue rank

A*

Where they publish

Papers

50 indexed papers, newest first.

YearVenueTitleAuthors
2022ICLRPlanning in Stochastic Environments with a Learned Model.Ioannis Antonoglou, Julian Schrittwieser, Sherjil Ozair, Thomas K. Hubert, David Silver
2022ICLRPolicy improvement by planning with Gumbel.Ivo Danihelka, Arthur Guez, Julian Schrittwieser, David Silver
2022ICLRBootstrapped Meta-Learning.Sebastian Flennerhag, Yannick Schroecker, Tom Zahavy, Hado van Hasselt, David Silver, Satinder Singh
2022ICLRLearning by Directional Gradient Descent.David Silver, Anirudh Goyal, Ivo Danihelka, Matteo Hessel, Hado van Hasselt
2021AAAIThe Value-Improvement Path: Towards Better Representations for Reinforcement Learning.Will Dabney, Andr Barreto, Mark Rowland, Robert Dadashi, John Quan, Marc G. Bellemare, David Silver
2021AAAIExpected Eligibility Traces.Hado van Hasselt, Sephora Madjiheurem, Matteo Hessel, David Silver, Andr Barreto, Diana Borsa
2021ICMLMuesli: Combining Improvements in Policy Optimization.Matteo Hessel, Ivo Danihelka, Fabio Viola, Arthur Guez, Simon Schmitt, Laurent Sifre, Theophane Weber, David Silver, Hado van Hasselt
2021ICMLLearning and Planning in Complex Action Spaces.Thomas Hubert, Julian Schrittwieser, Ioannis Antonoglou, Mohammadamin Barekatain, Simon Schmitt, David Silver
2020ICLRBehaviour Suite for Reinforcement Learning.Ian Osband, Yotam Doron, Matteo Hessel, John Aslanides, Eren Sezener, Andre Saraiva, Katrina McKinney, Tor Lattimore, Csaba Szepesvri, Satinder Singh, Benjamin Van Roy, Richard S. Sutton, David Silver, Hado van Hasselt
2020ICMLWhat Can Learned Intrinsic Rewards Capture?Zeyu Zheng, Junhyuk Oh, Matteo Hessel, Zhongwen Xu, Manuel Kroiss, Hado van Hasselt, David Silver, Satinder Singh
2019AISTATSCredit Assignment Techniques in Stochastic Computation Graphs.Thophane Weber, Nicolas Heess, Lars Buesing, David Silver
2019ICLRUniversal Successor Features Approximators.Diana Borsa, Andr Barreto, John Quan, Daniel J. Mankowitz, Hado van Hasselt, Rmi Munos, David Silver, Tom Schaul
2019ICMLAn Investigation of Model-Free Planning.Arthur Guez, Mehdi Mirza, Karol Gregor, Rishabh Kabra, Sbastien Racanire, Theophane Weber, David Raposo, Adam Santoro, Laurent Orseau, Tom Eccles, Greg Wayne, David Silver, Timothy P. Lillicrap
2018AAAIRainbow: Combining Improvements in Deep Reinforcement Learning.Matteo Hessel, Joseph Modayil, Hado van Hasselt, Tom Schaul, Georg Ostrovski, Will Dabney, Dan Horgan, Bilal Piot, Mohammad Gheshlaghi Azar, David Silver
2018ICLRDistributed Prioritized Experience Replay.Dan Horgan, John Quan, David Budden, Gabriel Barth-Maron, Matteo Hessel, Hado van Hasselt, David Silver
2018ICMLTransfer in Deep Reinforcement Learning Using Successor Features and Generalised Policy Improvement.Andr Barreto, Diana Borsa, John Quan, Tom Schaul, David Silver, Matteo Hessel, Daniel J. Mankowitz, Augustin Zdek, Rmi Munos
2018ICMLImplicit Quantile Networks for Distributional Reinforcement Learning.Will Dabney, Georg Ostrovski, David Silver, Rmi Munos
2018ICMLLearning to Search with MCTSnets.Arthur Guez, Theophane Weber, Ioannis Antonoglou, Karen Simonyan, Oriol Vinyals, Daan Wierstra, Rmi Munos, David Silver
2017ICLRReinforcement Learning with Unsupervised Auxiliary Tasks.Max Jaderberg, Volodymyr Mnih, Wojciech Marian Czarnecki, Tom Schaul, Joel Z. Leibo, David Silver, Koray Kavukcuoglu
2017ICMLDecoupled Neural Interfaces using Synthetic Gradients.Max Jaderberg, Wojciech Marian Czarnecki, Simon Osindero, Oriol Vinyals, Alex Graves, David Silver, Koray Kavukcuoglu
2017ICMLThe Predictron: End-To-End Learning and Planning.David Silver, Hado van Hasselt, Matteo Hessel, Tom Schaul, Arthur Guez, Tim Harley, Gabriel Dulac-Arnold, David P. Reichert, Neil C. Rabinowitz, Andr Barreto, Thomas Degris
2017ICMLFeUdal Networks for Hierarchical Reinforcement Learning.Alexander Sasha Vezhnevets, Simon Osindero, Tom Schaul, Nicolas Heess, Max Jaderberg, David Silver, Koray Kavukcuoglu
2016AAAIDeep Reinforcement Learning with Double Q-Learning.Hado van Hasselt, Arthur Guez, David Silver
2016ICMLAsynchronous Methods for Deep Reinforcement Learning.Volodymyr Mnih, Adri Puigdomnech Badia, Mehdi Mirza, Alex Graves, Timothy P. Lillicrap, Tim Harley, David Silver, Koray Kavukcuoglu
2015CSCWAuthenticity, Relatability and Collaborative Approaches to Sharing Knowledge about Assistive Living Technology.John Vines, Peter C. Wright, David Silver, Maggie Winchcombe, Patrick Olivier
2015ICMLFictitious Self-Play in Extensive-Form Games.Johannes Heinrich, Marc Lanctot, David Silver
2015ICMLUniversal Value Function Approximators.Tom Schaul, Daniel Horgan, Karol Gregor, David Silver
2015IJCAISmooth UCT Search in Computer Poker.Johannes Heinrich, David Silver
2015IROSScene understanding for a high-mobility walking robot.David M. Bradley, Jonathan K. Chang, David Silver, Matthew Powers, Herman Herman, Peter Rander, Anthony Stentz
2014ICMLDeterministic Policy Gradient Algorithms.David Silver, Guy Lever, Nicolas Heess, Thomas Degris, Daan Wierstra, Martin A. Riedmiller
2013ICMLConcurrent Reinforcement Learning from Customer Interactions.David Silver, Leonard Newnham, David Barker, Suzanne Weller, Jason McFall
2012ICMLCompositional Planning Using Optimal Option Models.David Silver, Kamil Ciosek
2012ICRAActive learning from demonstration for robust autonomous navigation.David Silver, J. Andrew Bagnell, Anthony Stentz
2011ACLLearning to Win by Reading Manuals in a Monte-Carlo Framework.S. R. K. Branavan, David Silver, Regina Barzilay
2011IJCAINon-Linear Monte-Carlo Search in Civilization II.S. R. K. Branavan, David Silver, Regina Barzilay
2011IROSMonte Carlo Localization and registration to prior data for outdoor navigation.David Silver, Anthony Stentz
2010AAAIReinforcement Learning via AIXI Approximation.Joel Veness, Kee Siong Ng, Marcus Hutter, David Silver
2009ICMLMonte-Carlo simulation balancing.David Silver, Gerald Tesauro
2009ICMLFast gradient-descent methods for temporal-difference learning with linear function approximation.Richard S. Sutton, Hamid Reza Maei, Doina Precup, Shalabh Bhatnagar, David Silver, Csaba Szepesvri, Eric Wiewiora
2009ISRRPerceptual Interpretation for Autonomous Navigation through Dynamic Imitation Learning.David Silver, J. Andrew Bagnell, Anthony Stentz
2008AAAIAchieving Master Level Play in 9 x 9 Computer Go.Sylvain Gelly, David Silver
2008ICMLSample-based learning and search with permanent and transient memories.David Silver, Richard S. Sutton, Martin Mller
2007ICMLCombining online and offline knowledge in UCT.Sylvain Gelly, David Silver
2007ICMLOn the role of tracking in stationary environments.Richard S. Sutton, Anna Koop, David Silver
2007IJCAIReinforcement Learning of Local Shape in the Game of Go.David Silver, Richard S. Sutton, Martin Mller
2006IROSExperimental Analysis of Overhead Data Processing To Support Long Range Navigation.David Silver, Boris Sofman, Nicolas Vandapel, J. Andrew Bagnell, Anthony Stentz
2005ICRATowards Topological Exploration of Abandoned Mines.Aaron Morris, David Silver, David I. Ferguson, Scott Thayer
2004IROSFeature extraction for topological mine maps.David Silver, Dave Ferguson, Aaron Morris, Scott Thayer
2004ICRAArc Carving: Obtaining Accurate, Low Latency Maps from Ultrasonic Range Sensors.David Silver, Deryck Morales, Ioannis M. Rekleitis, Brad Lisien, Howie Choset
2003IROSHierarchical simultaneous localization and mapping.Brad Lisien, Deryck Morales, David Silver, George Kantor, Ioannis M. Rekleitis, Howie Choset