George Tucker
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
25
Venues
6
Active years
2016–2025
Best venue rank
A*
Where they publish
Papers
25 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ICLR | Training Language Models to Self-Correct via Reinforcement Learning. | Aviral Kumar, Vincent Zhuang, Rishabh Agarwal, Yi Su, John D. Co-Reyes, Avi Singh, Kate Baumli, Shariq Iqbal, Colton Bishop, Rebecca Roelofs, Lei M. Zhang, Kay McKinney, Disha Shrivastava, Cosmin Paduraru, George Tucker, Doina Precup, Feryal M. P. Behbahani, Aleksandra Faust |
| 2023 | ICLR | Offline Q-learning on Diverse Multi-Task Data Both Scales And Generalizes. | Aviral Kumar, Rishabh Agarwal, Xinyang Geng, George Tucker, Sergey Levine |
| 2023 | IROS | Imitation Is Not Enough: Robustifying Imitation with Reinforcement Learning for Challenging Driving Scenarios. | Yiren Lu, Justin Fu, George Tucker, Xinlei Pan, Eli Bronstein, Rebecca Roelofs, Benjamin Sapp, Brandyn White, Aleksandra Faust, Shimon Whiteson, Dragomir Anguelov, Sergey Levine |
| 2022 | AISTATS | Offline Policy Selection under Uncertainty. | Mengjiao Yang, Bo Dai, Ofir Nachum, George Tucker, Dale Schuurmans |
| 2022 | ICLR | DR3: Value-Based Deep Reinforcement Learning Requires Explicit Regularization. | Aviral Kumar, Rishabh Agarwal, Tengyu Ma, Aaron C. Courville, George Tucker, Sergey Levine |
| 2022 | ICML | Model Selection in Batch Policy Optimization. | Jonathan Lee, George Tucker, Ofir Nachum, Bo Dai |
| 2021 | ICLR | Benchmarks for Deep Off-Policy Evaluation. | Justin Fu, Mohammad Norouzi, Ofir Nachum, George Tucker, Ziyu Wang, Alexander Novikov, Mengjiao Yang, Michael R. Zhang, Yutian Chen, Aviral Kumar, Cosmin Paduraru, Sergey Levine, Tom Le Paine |
| 2021 | ICLR | Autoregressive Dynamics Models for Offline Policy Evaluation and Optimization. | Michael R. Zhang, Thomas Paine, Ofir Nachum, Cosmin Paduraru, George Tucker, Ziyu Wang, Mohammad Norouzi |
| 2020 | ICLR | Model Based Reinforcement Learning for Atari. | Lukasz Kaiser, Mohammad Babaeizadeh, Piotr Milos, Blazej Osinski, Roy H. Campbell, Konrad Czechowski, Dumitru Erhan, Chelsea Finn, Piotr Kozakowski, Sergey Levine, Afroz Mohiuddin, Ryan Sepassi, George Tucker, Henryk Michalewski |
| 2020 | ICLR | Meta-Learning without Memorization. | Mingzhang Yin, George Tucker, Mingyuan Zhou, Sergey Levine, Chelsea Finn |
| 2019 | ICLR | Revisiting Auxiliary Latent Variables in Generative Models. | Dieterich Lawson, George Tucker, Bo Dai, Rajesh Ranganath |
| 2019 | ICLR | Understanding Posterior Collapse in Generative Latent Variable Models. | James Lucas, George Tucker, Roger B. Grosse, Mohammad Norouzi |
| 2019 | ICLR | Doubly Reparameterized Gradient Estimators for Monte Carlo Objectives. | George Tucker, Dieterich Lawson, Shixiang Gu, Chris J. Maddison |
| 2019 | ICLR | The Laplacian in RL: Learning Representations with Efficient Approximations. | Yifan Wu, George Tucker, Ofir Nachum |
| 2019 | ICML | Guided evolutionary strategies: augmenting random search with surrogate gradients. | Niru Maheswaranathan, Luke Metz, George Tucker, Dami Choi, Jascha Sohl-Dickstein |
| 2019 | ICML | On Variational Bounds of Mutual Information. | Ben Poole, Sherjil Ozair, Aron van den Oord, Alexander A. Alemi, George Tucker |
| 2018 | ICASSP | Learning Hard Alignments with Variational Inference. | Dieterich Lawson, Chung-Cheng Chiu, George Tucker, Colin Raffel, Kevin Swersky, Navdeep Jaitly |
| 2018 | ICLR | Deep Bayesian Bandits Showdown: An Empirical Comparison of Bayesian Deep Networks for Thompson Sampling. | Carlos Riquelme, George Tucker, Jasper Snoek |
| 2018 | ICLR | The Mirage of Action-Dependent Baselines in Reinforcement Learning. | George Tucker, Surya Bhupatiraju, Shixiang Gu, Richard E. Turner, Zoubin Ghahramani, Sergey Levine |
| 2018 | ICML | Smoothed Action Value Functions for Learning Gaussian Policies. | Ofir Nachum, Mohammad Norouzi, George Tucker, Dale Schuurmans |
| 2018 | ICML | The Mirage of Action-Dependent Baselines in Reinforcement Learning. | George Tucker, Surya Bhupatiraju, Shixiang Gu, Richard E. Turner, Zoubin Ghahramani, Sergey Levine |
| 2017 | ICLR | Particle Value Functions. | Chris J. Maddison, Dieterich Lawson, George Tucker, Nicolas Heess, Arnaud Doucet, Andriy Mnih, Yee Whye Teh |
| 2017 | ICLR | Regularizing Neural Networks by Penalizing Confident Output Distributions. | Gabriel Pereyra, George Tucker, Jan Chorowski, Lukasz Kaiser, Geoffrey E. Hinton |
| 2017 | ICLR | REBAR: Low-variance, unbiased gradient estimates for discrete latent variable models. | George Tucker, Andriy Mnih, Chris J. Maddison, Jascha Sohl-Dickstein |
| 2016 | Interspeech | Model Compression Applied to Small-Footprint Keyword Spotting. | George Tucker, Minhua Wu, Ming Sun, Sankaran Panchapagesan, Gengshen Fu, Shiv Vitaladevuni |