Tom Zahavy
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
21
Venues
7
Active years
2014–2025
Best venue rank
A*
Where they publish
Papers
21 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ICML | Mastering Board Games by External and Internal Planning with Language Models. | John Schultz, Jakub Admek, Matej Jusup, Marc Lanctot, Michael Kaisers, Sarah Perrin, Daniel Hennes, Jeremy Shar, Cannada A. Lewis, Anian Ruoss, Tom Zahavy, Petar Velickovic, Laurel Prince, Satinder Singh, Eric Malmi, Nenad Tomasev |
| 2023 | GECCO | Discovering Attention-Based Genetic Algorithms via Meta-Black-Box Optimization. | Robert Tjarko Lange, Tom Schaul, Yutian Chen, Chris Lu, Tom Zahavy, Valentin Dalibard, Sebastian Flennerhag |
| 2023 | GECCO | Discovering Evolution Strategies via Meta-Black-Box Optimization. | Robert Tjarko Lange, Tom Schaul, Yutian Chen, Tom Zahavy, Valentin Dalibard, Chris Lu, Satinder Singh, Sebastian Flennerhag |
| 2023 | ICLR | Discovering Evolution Strategies via Meta-Black-Box Optimization. | Robert Tjarko Lange, Tom Schaul, Yutian Chen, Tom Zahavy, Valentin Dalibard, Chris Lu, Satinder Singh, Sebastian Flennerhag |
| 2023 | ICLR | Discovering Policies with DOMiNO: Diversity Optimization Maintaining Near Optimality. | Tom Zahavy, Yannick Schroecker, Feryal M. P. Behbahani, Kate Baumli, Sebastian Flennerhag, Shaobo Hou, Satinder Singh |
| 2023 | ICML | ReLOAD: Reinforcement Learning with Optimistic Ascent-Descent for Last-Iterate Convergence in Constrained MDPs. | Ted Moskovitz, Brendan O'Donoghue, Vivek Veeriah, Sebastian Flennerhag, Satinder Singh, Tom Zahavy |
| 2022 | AAAI | Online Apprenticeship Learning. | Lior Shani, Tom Zahavy, Shie Mannor |
| 2022 | ICLR | Bootstrapped Meta-Learning. | Sebastian Flennerhag, Yannick Schroecker, Tom Zahavy, Hado van Hasselt, David Silver, Satinder Singh |
| 2021 | ICLR | Balancing Constraints and Rewards with Meta-Gradient D4PG. | Dan A. Calian, Daniel J. Mankowitz, Tom Zahavy, Zhongwen Xu, Junhyuk Oh, Nir Levine, Timothy A. Mann |
| 2021 | ICLR | Discovering a set of policies for the worst case reward. | Tom Zahavy, Andr Barreto, Daniel J. Mankowitz, Shaobo Hou, Brendan O'Donoghue, Iurii Kemaev, Satinder Singh |
| 2021 | ICML | Emphatic Algorithms for Deep Reinforcement Learning. | Ray Jiang, Tom Zahavy, Zhongwen Xu, Adam White, Matteo Hessel, Charles Blundell, Hado van Hasselt |
| 2021 | ICML | Online Limited Memory Neural-Linear Bandits with Likelihood Matching. | Ofir Nabati, Tom Zahavy, Shie Mannor |
| 2020 | AAAI | Apprenticeship Learning via Frank-Wolfe. | Tom Zahavy, Alon Cohen, Haim Kaplan, Yishay Mansour |
| 2020 | ALT | Planning in Hierarchical Reinforcement Learning: Guarantees for Using Local Policies. | Tom Zahavy, Avinatan Hassidim, Haim Kaplan, Yishay Mansour |
| 2020 | UAI | Unknown mixing times in apprenticeship and reinforcement learning. | Tom Zahavy, Alon Cohen, Haim Kaplan, Yishay Mansour |
| 2018 | AAAI | Is a Picture Worth a Thousand Words? A Deep Multi-Modal Architecture for Product Classification in E-Commerce. | Tom Zahavy, Abhinandan Krishnan, Alessandro Magnani, Shie Mannor |
| 2018 | ICLR | Learning How Not to Act in Text-based Games. | Matan Haroush, Tom Zahavy, Daniel J. Mankowitz, Shie Mannor |
| 2018 | ICLR | Ensemble Robustness and Generalization of Stochastic Deep Learning Algorithms. | Tom Zahavy, Bingyi Kang, Alex Sivak, Jiashi Feng, Huan Xu, Shie Mannor |
| 2017 | AAAI | A Deep Hierarchical Approach to Lifelong Learning in Minecraft. | Chen Tessler, Shahar Givony, Tom Zahavy, Daniel J. Mankowitz, Shie Mannor |
| 2016 | ICML | Graying the black box: Understanding DQNs. | Tom Zahavy, Nir Ben-Zrihem, Shie Mannor |
| 2014 | ICASSP | Sub-Nyquist sampling of OFDM signals for cognitive radios. | Tom Zahavy, Oran Shayer, Deborah Cohen, Alex Tolmachev, Yonina C. Eldar |