Skip to content

Tom Schaul

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

43

Venues

9

Active years

2008–2025

Best venue rank

A*

Where they publish

Papers

43 indexed papers, newest first.

YearVenueTitleAuthors
2025ICMLAuPair: Golden Example Pairs for Code Repair.Aditi Mavalankar, Hassan Mansoor, Zita Marinho, Mariia Samsikova, Tom Schaul
2024ICMLPosition: Open-Endedness is Essential for Artificial Superhuman Intelligence.Edward Hughes, Michael D. Dennis, Jack Parker-Holder, Feryal M. P. Behbahani, Aditi Mavalankar, Yuge Shi, Tom Schaul, Tim Rocktschel
2023GECCODiscovering Attention-Based Genetic Algorithms via Meta-Black-Box Optimization.Robert Tjarko Lange, Tom Schaul, Yutian Chen, Chris Lu, Tom Zahavy, Valentin Dalibard, Sebastian Flennerhag
2023GECCODiscovering Evolution Strategies via Meta-Black-Box Optimization.Robert Tjarko Lange, Tom Schaul, Yutian Chen, Tom Zahavy, Valentin Dalibard, Chris Lu, Satinder Singh, Sebastian Flennerhag
2023ICLRDiscovering Evolution Strategies via Meta-Black-Box Optimization.Robert Tjarko Lange, Tom Schaul, Yutian Chen, Tom Zahavy, Valentin Dalibard, Chris Lu, Satinder Singh, Sebastian Flennerhag
2023IJCAIScaling Goal-based Exploration via Pruning Proto-goals.Akhil Bagaria, Tom Schaul
2022ICLRWhen should agents explore?Miruna Pislar, David Szepesvari, Georg Ostrovski, Diana L. Borsa, Tom Schaul
2022ICMLModel-Value Inconsistency as a Signal for Epistemic Uncertainty.Angelos Filos, Eszter Vrtes, Zita Marinho, Gregory Farquhar, Diana Borsa, Abram L. Friesen, Feryal M. P. Behbahani, Tom Schaul, Andr Barreto, Simon Osindero
2020AISTATSConditional Importance Sampling for Off-Policy Learning.Mark Rowland, Anna Harutyunyan, Hado van Hasselt, Diana Borsa, Tom Schaul, Rmi Munos, Will Dabney
2019ICLRUniversal Successor Features Approximators.Diana Borsa, Andr Barreto, John Quan, Daniel J. Mankowitz, Hado van Hasselt, Rmi Munos, David Silver, Tom Schaul
2018AAAIRainbow: Combining Improvements in Deep Reinforcement Learning.Matteo Hessel, Joseph Modayil, Hado van Hasselt, Tom Schaul, Georg Ostrovski, Will Dabney, Dan Horgan, Bilal Piot, Mohammad Gheshlaghi Azar, David Silver
2018AAAIDeep Q-learning From Demonstrations.Todd Hester, Matej Vecerk, Olivier Pietquin, Marc Lanctot, Tom Schaul, Bilal Piot, Dan Horgan, John Quan, Andrew Sendonaris, Ian Osband, Gabriel Dulac-Arnold, John P. Agapiou, Joel Z. Leibo, Audrunas Gruslys
2018GECCOMeta-learning by the baldwin effect.Chrisantha Fernando, Jakub Sygnowski, Simon Osindero, Jane Wang, Tom Schaul, Denis Teplyashin, Pablo Sprechmann, Alexander Pritzel, Andrei A. Rusu
2018GECCOMeta-learning by the Baldwin effect.Chrisantha Fernando, Jakub Sygnowski, Simon Osindero, Jane Wang, Tom Schaul, Denis Teplyashin, Pablo Sprechmann, Alexander Pritzel, Andrei A. Rusu
2018ICMLTransfer in Deep Reinforcement Learning Using Successor Features and Generalised Policy Improvement.Andr Barreto, Diana Borsa, John Quan, Tom Schaul, David Silver, Matteo Hessel, Daniel J. Mankowitz, Augustin Zdek, Rmi Munos
2017ICLRReinforcement Learning with Unsupervised Auxiliary Tasks.Max Jaderberg, Volodymyr Mnih, Wojciech Marian Czarnecki, Tom Schaul, Joel Z. Leibo, David Silver, Koray Kavukcuoglu
2017ICMLThe Predictron: End-To-End Learning and Planning.David Silver, Hado van Hasselt, Matteo Hessel, Tom Schaul, Arthur Guez, Tim Harley, Gabriel Dulac-Arnold, David P. Reichert, Neil C. Rabinowitz, Andr Barreto, Thomas Degris
2017ICMLFeUdal Networks for Hierarchical Reinforcement Learning.Alexander Sasha Vezhnevets, Simon Osindero, Tom Schaul, Nicolas Heess, Max Jaderberg, David Silver, Koray Kavukcuoglu
2016AAAIGeneral Video Game AI: Competition, Challenges and Opportunities.Diego Perez Liebana, Spyridon Samothrakis, Julian Togelius, Tom Schaul, Simon M. Lucas
2016ICMLDueling Network Architectures for Deep Reinforcement Learning.Ziyu Wang, Tom Schaul, Matteo Hessel, Hado van Hasselt, Marc Lanctot, Nando de Freitas
2015ICMLUniversal Value Function Approximators.Tom Schaul, Daniel Horgan, Karol Gregor, David Silver
2013GECCOA linear time natural evolution strategy for non-separable functions.Yi Sun, Tom Schaul, Faustino J. Gomez, Jrgen Schmidhuber
2013ICMLNo more pesky learning rates.Tom Schaul, Sixin Zhang, Yann LeCun
2013IJCAIBetter Generalization with Forecasts.Tom Schaul, Mark B. Ring
2012GECCONatural evolution strategies converge on sphere functions.Tom Schaul
2012GECCOBenchmarking separable natural evolution strategies on the noiseless and noisy black-box optimization testbeds.Tom Schaul
2012GECCOBenchmarking exponential natural evolution strategies on the noiseless and noisy black-box optimization testbeds.Tom Schaul
2012GECCOInvestigating the impact of adaptation sampling in natural evolution strategies on black-box optimization testbeds.Tom Schaul
2012GECCOBenchmarking natural evolution strategies with adaptation sampling on the noiseless and noisy black-box optimization testbeds.Tom Schaul
2012GECCOComparing natural evolution strategies to BIPOP-CMA-ES on noiseless and noisy black-box optimization testbeds.Tom Schaul
2011CECCuriosity-driven optimization.Tom Schaul, Yi Sun, Daan Wierstra, Faustino J. Gomez, Jrgen Schmidhuber
2011GECCOHigh dimensions and heavy tails for natural evolution strategies.Tom Schaul, Tobias Glasmachers, Jrgen Schmidhuber
2011IJCAIQ-Error as a Selection Mechanism in Modular Reinforcement-Learning Systems.Mark B. Ring, Tom Schaul
2010GECCOExponential natural evolution strategies.Tobias Glasmachers, Tom Schaul, Yi Sun, Daan Wierstra, Jrgen Schmidhuber
2010ICANNMulti-Dimensional Deep Memory Atari-Go Players for Parameter Exploring Policy Gradients.Mandy Grttner, Frank Sehnke, Tom Schaul, Jrgen Schmidhuber
2010PPSNA Natural Evolution Strategy for Multi-objective Optimization.Tobias Glasmachers, Tom Schaul, Jrgen Schmidhuber
2009GECCOEfficient natural evolution strategies.Yi Sun, Daan Wierstra, Tom Schaul, Jrgen Schmidhuber
2009ICANNScalable Neural Networks for Board Games.Tom Schaul, Jrgen Schmidhuber
2009ICMLStochastic search using the natural gradient.Yi Sun, Daan Wierstra, Tom Schaul, Jrgen Schmidhuber
2008CECNatural Evolution Strategies.Daan Wierstra, Tom Schaul, Jan Peters, Jrgen Schmidhuber
2008ICANNEpisodic Reinforcement Learning by Logistic Reward-Weighted Regression.Daan Wierstra, Tom Schaul, Jan Peters, Jrgen Schmidhuber
2008PPSNCountering Poisonous Inputs with Memetic Neuroevolution.Julian Togelius, Tom Schaul, Jrgen Schmidhuber, Faustino J. Gomez
2008PPSNFitness Expectation Maximization.Daan Wierstra, Tom Schaul, Jan Peters, Jrgen Schmidhuber