Skip to content

Yonathan Efroni

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

24

Venues

6

Active years

2018–2026

Best venue rank

A*

Where they publish

Papers

24 indexed papers, newest first.

YearVenueTitleAuthors
2026EACLImbalanced Gradients in RL Post-Training of Multi-Task LLMs.Runzhe Wu, Ankur Samanta, Ayush Jain, Scott Fujimoto, Jeongyeol Kwon, Ben Kretzu, Youliang Yu, Kaveh Hassani, Boris Vidolov, Yonathan Efroni
2025ICLRTime After Time: Deep-Q Effect Estimation for Interventions on When and What to do.Yoav Wald, Mark Goldstein, Yonathan Efroni, Wouter A. C. van Amsterdam, Rajesh Ranganath
2025ICLRExploiting Structure in Offline Multi-Agent RL: The Benefits of Low Interaction Rank.Wenhao Zhan, Scott Fujimoto, Zheqing Zhu, Jason D. Lee, Daniel Jiang, Yonathan Efroni
2025ICMLAligned Multi Objective Optimization.Yonathan Efroni, Ben Kretzu, Daniel Jiang, Jalaj Bhandari, Zheqing Zhu, Karen Ullrich
2024ICMLPcLast: Discovering Plannable Continuous Latent States.Anurag Koul, Shivakanth Sujit, Shaoru Chen, Ben Evans, Lili Wu, Byron Xu, Rajan Chari, Riashat Islam, Raihan Seraj, Yonathan Efroni, Lekan P. Molu, Miroslav Dudk, John Langford, Alex Lamb
2024ICMLProspective Side Information for Latent MDPs.Jeongyeol Kwon, Yonathan Efroni, Shie Mannor, Constantine Caramanis
2023ICMLPrincipled Offline RL in the Presence of Rich Exogenous Information.Riashat Islam, Manan Tomar, Alex Lamb, Yonathan Efroni, Hongyu Zang, Aniket Rajiv Didolkar, Dipendra Misra, Xin Li, Harm van Seijen, Remi Tachet des Combes, John Langford
2023ICMLReward-Mixing MDPs with Few Latent Contexts are Learnable.Jeongyeol Kwon, Yonathan Efroni, Constantine Caramanis, Shie Mannor
2022COLTSample-Efficient Reinforcement Learning in the Presence of Exogenous Information.Yonathan Efroni, Dylan J. Foster, Dipendra Misra, Akshay Krishnamurthy, John Langford
2022ICLRProvably Filtering Exogenous Distractors using Multistep Inverse Dynamics.Yonathan Efroni, Dipendra Misra, Akshay Krishnamurthy, Alekh Agarwal, John Langford
2022ICLRMirror Descent Policy Optimization.Manan Tomar, Lior Shani, Yonathan Efroni, Mohammad Ghavamzadeh
2022ICMLProvable Reinforcement Learning with a Short-Term Memory.Yonathan Efroni, Chi Jin, Akshay Krishnamurthy, Sobhan Miryoosefi
2022ICMLSparsity in Partially Controllable Linear Systems.Yonathan Efroni, Sham M. Kakade, Akshay Krishnamurthy, Cyril Zhang
2022ICMLCoordinated Attacks against Contextual Bandits: Fundamental Limits and Defense Mechanisms.Jeongyeol Kwon, Yonathan Efroni, Constantine Caramanis, Shie Mannor
2021AAAIReinforcement Learning with Trajectory Feedback.Yonathan Efroni, Nadav Merlis, Shie Mannor
2021ICMLConfidence-Budget Matching for Sequential Budgeted Learning.Yonathan Efroni, Nadav Merlis, Aadirupa Saha, Shie Mannor
2021UAIBandits with partially observable confounded data.Guy Tennenholtz, Uri Shalit, Shie Mannor, Yonathan Efroni
2020AAAIAdaptive Trust Region Policy Optimization: Global Convergence and Faster Rates for Regularized MDPs.Lior Shani, Yonathan Efroni, Shie Mannor
2020ICMLOptimistic Policy Optimization with Bandit Feedback.Lior Shani, Yonathan Efroni, Aviv Rosenberg, Shie Mannor
2020ICMLMulti-step Greedy Reinforcement Learning Algorithms.Manan Tomar, Yonathan Efroni, Mohammad Ghavamzadeh
2019AAAIHow to Combine Tree-Search Methods in Reinforcement Learning.Yonathan Efroni, Gal Dalal, Bruno Scherrer, Shie Mannor
2019ICMLExploration Conscious Reinforcement Learning Revisited.Lior Shani, Yonathan Efroni, Shie Mannor
2019ICMLAction Robust Reinforcement Learning and Applications in Continuous Control.Chen Tessler, Yonathan Efroni, Shie Mannor
2018ICMLBeyond the One-Step Greedy Approach in Reinforcement Learning.Yonathan Efroni, Gal Dalal, Bruno Scherrer, Shie Mannor