Skip to content

Tom Zahavy

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

21

Venues

7

Active years

2014–2025

Best venue rank

A*

Where they publish

Papers

21 indexed papers, newest first.

YearVenueTitleAuthors
2025ICMLMastering Board Games by External and Internal Planning with Language Models.John Schultz, Jakub Admek, Matej Jusup, Marc Lanctot, Michael Kaisers, Sarah Perrin, Daniel Hennes, Jeremy Shar, Cannada A. Lewis, Anian Ruoss, Tom Zahavy, Petar Velickovic, Laurel Prince, Satinder Singh, Eric Malmi, Nenad Tomasev
2023GECCODiscovering Attention-Based Genetic Algorithms via Meta-Black-Box Optimization.Robert Tjarko Lange, Tom Schaul, Yutian Chen, Chris Lu, Tom Zahavy, Valentin Dalibard, Sebastian Flennerhag
2023GECCODiscovering Evolution Strategies via Meta-Black-Box Optimization.Robert Tjarko Lange, Tom Schaul, Yutian Chen, Tom Zahavy, Valentin Dalibard, Chris Lu, Satinder Singh, Sebastian Flennerhag
2023ICLRDiscovering Evolution Strategies via Meta-Black-Box Optimization.Robert Tjarko Lange, Tom Schaul, Yutian Chen, Tom Zahavy, Valentin Dalibard, Chris Lu, Satinder Singh, Sebastian Flennerhag
2023ICLRDiscovering Policies with DOMiNO: Diversity Optimization Maintaining Near Optimality.Tom Zahavy, Yannick Schroecker, Feryal M. P. Behbahani, Kate Baumli, Sebastian Flennerhag, Shaobo Hou, Satinder Singh
2023ICMLReLOAD: Reinforcement Learning with Optimistic Ascent-Descent for Last-Iterate Convergence in Constrained MDPs.Ted Moskovitz, Brendan O'Donoghue, Vivek Veeriah, Sebastian Flennerhag, Satinder Singh, Tom Zahavy
2022AAAIOnline Apprenticeship Learning.Lior Shani, Tom Zahavy, Shie Mannor
2022ICLRBootstrapped Meta-Learning.Sebastian Flennerhag, Yannick Schroecker, Tom Zahavy, Hado van Hasselt, David Silver, Satinder Singh
2021ICLRBalancing Constraints and Rewards with Meta-Gradient D4PG.Dan A. Calian, Daniel J. Mankowitz, Tom Zahavy, Zhongwen Xu, Junhyuk Oh, Nir Levine, Timothy A. Mann
2021ICLRDiscovering a set of policies for the worst case reward.Tom Zahavy, Andr Barreto, Daniel J. Mankowitz, Shaobo Hou, Brendan O'Donoghue, Iurii Kemaev, Satinder Singh
2021ICMLEmphatic Algorithms for Deep Reinforcement Learning.Ray Jiang, Tom Zahavy, Zhongwen Xu, Adam White, Matteo Hessel, Charles Blundell, Hado van Hasselt
2021ICMLOnline Limited Memory Neural-Linear Bandits with Likelihood Matching.Ofir Nabati, Tom Zahavy, Shie Mannor
2020AAAIApprenticeship Learning via Frank-Wolfe.Tom Zahavy, Alon Cohen, Haim Kaplan, Yishay Mansour
2020ALTPlanning in Hierarchical Reinforcement Learning: Guarantees for Using Local Policies.Tom Zahavy, Avinatan Hassidim, Haim Kaplan, Yishay Mansour
2020UAIUnknown mixing times in apprenticeship and reinforcement learning.Tom Zahavy, Alon Cohen, Haim Kaplan, Yishay Mansour
2018AAAIIs a Picture Worth a Thousand Words? A Deep Multi-Modal Architecture for Product Classification in E-Commerce.Tom Zahavy, Abhinandan Krishnan, Alessandro Magnani, Shie Mannor
2018ICLRLearning How Not to Act in Text-based Games.Matan Haroush, Tom Zahavy, Daniel J. Mankowitz, Shie Mannor
2018ICLREnsemble Robustness and Generalization of Stochastic Deep Learning Algorithms.Tom Zahavy, Bingyi Kang, Alex Sivak, Jiashi Feng, Huan Xu, Shie Mannor
2017AAAIA Deep Hierarchical Approach to Lifelong Learning in Minecraft.Chen Tessler, Shahar Givony, Tom Zahavy, Daniel J. Mankowitz, Shie Mannor
2016ICMLGraying the black box: Understanding DQNs.Tom Zahavy, Nir Ben-Zrihem, Shie Mannor
2014ICASSPSub-Nyquist sampling of OFDM signals for cognitive radios.Tom Zahavy, Oran Shayer, Deborah Cohen, Alex Tolmachev, Yonina C. Eldar