Skip to content

George Tucker

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

25

Venues

6

Active years

2016–2025

Best venue rank

A*

Where they publish

Papers

25 indexed papers, newest first.

YearVenueTitleAuthors
2025ICLRTraining Language Models to Self-Correct via Reinforcement Learning.Aviral Kumar, Vincent Zhuang, Rishabh Agarwal, Yi Su, John D. Co-Reyes, Avi Singh, Kate Baumli, Shariq Iqbal, Colton Bishop, Rebecca Roelofs, Lei M. Zhang, Kay McKinney, Disha Shrivastava, Cosmin Paduraru, George Tucker, Doina Precup, Feryal M. P. Behbahani, Aleksandra Faust
2023ICLROffline Q-learning on Diverse Multi-Task Data Both Scales And Generalizes.Aviral Kumar, Rishabh Agarwal, Xinyang Geng, George Tucker, Sergey Levine
2023IROSImitation Is Not Enough: Robustifying Imitation with Reinforcement Learning for Challenging Driving Scenarios.Yiren Lu, Justin Fu, George Tucker, Xinlei Pan, Eli Bronstein, Rebecca Roelofs, Benjamin Sapp, Brandyn White, Aleksandra Faust, Shimon Whiteson, Dragomir Anguelov, Sergey Levine
2022AISTATSOffline Policy Selection under Uncertainty.Mengjiao Yang, Bo Dai, Ofir Nachum, George Tucker, Dale Schuurmans
2022ICLRDR3: Value-Based Deep Reinforcement Learning Requires Explicit Regularization.Aviral Kumar, Rishabh Agarwal, Tengyu Ma, Aaron C. Courville, George Tucker, Sergey Levine
2022ICMLModel Selection in Batch Policy Optimization.Jonathan Lee, George Tucker, Ofir Nachum, Bo Dai
2021ICLRBenchmarks for Deep Off-Policy Evaluation.Justin Fu, Mohammad Norouzi, Ofir Nachum, George Tucker, Ziyu Wang, Alexander Novikov, Mengjiao Yang, Michael R. Zhang, Yutian Chen, Aviral Kumar, Cosmin Paduraru, Sergey Levine, Tom Le Paine
2021ICLRAutoregressive Dynamics Models for Offline Policy Evaluation and Optimization.Michael R. Zhang, Thomas Paine, Ofir Nachum, Cosmin Paduraru, George Tucker, Ziyu Wang, Mohammad Norouzi
2020ICLRModel Based Reinforcement Learning for Atari.Lukasz Kaiser, Mohammad Babaeizadeh, Piotr Milos, Blazej Osinski, Roy H. Campbell, Konrad Czechowski, Dumitru Erhan, Chelsea Finn, Piotr Kozakowski, Sergey Levine, Afroz Mohiuddin, Ryan Sepassi, George Tucker, Henryk Michalewski
2020ICLRMeta-Learning without Memorization.Mingzhang Yin, George Tucker, Mingyuan Zhou, Sergey Levine, Chelsea Finn
2019ICLRRevisiting Auxiliary Latent Variables in Generative Models.Dieterich Lawson, George Tucker, Bo Dai, Rajesh Ranganath
2019ICLRUnderstanding Posterior Collapse in Generative Latent Variable Models.James Lucas, George Tucker, Roger B. Grosse, Mohammad Norouzi
2019ICLRDoubly Reparameterized Gradient Estimators for Monte Carlo Objectives.George Tucker, Dieterich Lawson, Shixiang Gu, Chris J. Maddison
2019ICLRThe Laplacian in RL: Learning Representations with Efficient Approximations.Yifan Wu, George Tucker, Ofir Nachum
2019ICMLGuided evolutionary strategies: augmenting random search with surrogate gradients.Niru Maheswaranathan, Luke Metz, George Tucker, Dami Choi, Jascha Sohl-Dickstein
2019ICMLOn Variational Bounds of Mutual Information.Ben Poole, Sherjil Ozair, Aron van den Oord, Alexander A. Alemi, George Tucker
2018ICASSPLearning Hard Alignments with Variational Inference.Dieterich Lawson, Chung-Cheng Chiu, George Tucker, Colin Raffel, Kevin Swersky, Navdeep Jaitly
2018ICLRDeep Bayesian Bandits Showdown: An Empirical Comparison of Bayesian Deep Networks for Thompson Sampling.Carlos Riquelme, George Tucker, Jasper Snoek
2018ICLRThe Mirage of Action-Dependent Baselines in Reinforcement Learning.George Tucker, Surya Bhupatiraju, Shixiang Gu, Richard E. Turner, Zoubin Ghahramani, Sergey Levine
2018ICMLSmoothed Action Value Functions for Learning Gaussian Policies.Ofir Nachum, Mohammad Norouzi, George Tucker, Dale Schuurmans
2018ICMLThe Mirage of Action-Dependent Baselines in Reinforcement Learning.George Tucker, Surya Bhupatiraju, Shixiang Gu, Richard E. Turner, Zoubin Ghahramani, Sergey Levine
2017ICLRParticle Value Functions.Chris J. Maddison, Dieterich Lawson, George Tucker, Nicolas Heess, Arnaud Doucet, Andriy Mnih, Yee Whye Teh
2017ICLRRegularizing Neural Networks by Penalizing Confident Output Distributions.Gabriel Pereyra, George Tucker, Jan Chorowski, Lukasz Kaiser, Geoffrey E. Hinton
2017ICLRREBAR: Low-variance, unbiased gradient estimates for discrete latent variable models.George Tucker, Andriy Mnih, Chris J. Maddison, Jascha Sohl-Dickstein
2016InterspeechModel Compression Applied to Small-Footprint Keyword Spotting.George Tucker, Minhua Wu, Ming Sun, Sankaran Panchapagesan, Gengshen Fu, Shiv Vitaladevuni