| 2025 | AAAI | Delay as Payoff in MAB. | Ofir Schlisselberg, Ido Cohen, Tal Lancewicki, Yishay Mansour |
| 2025 | ICML | Near-optimal Regret Using Policy Optimization in Online MDPs with Aggregate Bandit Feedback. | Tal Lancewicki, Yishay Mansour |
| 2023 | COLT | A Unified Analysis of Nonstochastic Delayed Feedback for Combinatorial Semi-Bandits, Linear Bandits, and MDPs. | Dirk van der Hoeven, Lukas Zierahn, Tal Lancewicki, Aviv Rosenberg, Nicol Cesa-Bianchi |
| 2023 | ICML | Regret Minimization and Convergence to Equilibria in General-sum Markov Games. | Liad Erez, Tal Lancewicki, Uri Sherman, Tomer Koren, Yishay Mansour |
| 2023 | ICML | Delay-Adapted Policy Optimization and Improved Regret for Adversarial MDP with Delayed Bandit Feedback. | Tal Lancewicki, Aviv Rosenberg, Dmitry Sotnikov |
| 2022 | AAAI | Learning Adversarial Markov Decision Processes with Delayed Feedback. | Tal Lancewicki, Aviv Rosenberg, Yishay Mansour |
| 2022 | ICML | Cooperative Online Learning in Stochastic and Adversarial MDPs. | Tal Lancewicki, Aviv Rosenberg, Yishay Mansour |
| 2021 | ICML | Stochastic Multi-Armed Bandits with Unrestricted Delay Distributions. | Tal Lancewicki, Shahar Segal, Tomer Koren, Yishay Mansour |