| 2025 | CVPR | RL-RC-DoT: A Block-level RL agent for Task-Aware Video Compression. | Uri Gadot, Assaf Shocher, Shie Mannor, Gal Chechik, Assaf Hallak |
| 2025 | ICLR | Global Convergence of Policy Gradient in Average Reward MDPs. | Navdeep Kumar, Yashaswini Murthy, Itai Shufaro, Kfir Yehuda Levy, R. Srikant, Shie Mannor |
| 2025 | ICLR | On Bits and Bandits: Quantifying the Regret-Information Trade-off. | Itai Shufaro, Nadav Merlis, Nir Weinberger, Shie Mannor |
| 2025 | ICML | Policy Gradient with Tree Expansion. | Gal Dalal, Assaf Hallak, Gugan Thoppe, Shie Mannor, Gal Chechik |
| 2025 | ICML | Reinforcement Learning with Segment Feedback. | Yihan Du, Anna Winnicki, Gal Dalal, Shie Mannor, R. Srikant |
| 2025 | ICML | A Classification View on Meta Learning Bandits. | Mirco Mutti, Jeongyeol Kwon, Shie Mannor, Aviv Tamar |
| 2024 | AAAI | Solving Non-rectangular Reward-Robust MDPs via Frequency Regularization. | Uri Gadot, Esther Derman, Navdeep Kumar, Maxence Mohamed Elfatihi, Kfir Levy, Shie Mannor |
| 2024 | ECCV | PlaMo: Plan and Move in Rich 3D Physical Environments. | Assaf Hallak, Gal Dalal, Chen Tessler, Kelly Guo, Shie Mannor, Gal Chechik |
| 2024 | ICLR | Policy Gradient with Tree Search (PGTS) in Reinforcement Learning Evades Local Maxima. | Navdeep Kumar, Priyank Agrawal, Kfir Yehuda Levy, Shie Mannor |
| 2024 | ICLR | Towards Faster Global Convergence of Robust Policy Gradient Methods. | Navdeep Kumar, Ilnura Usmanova, Kfir Yehuda Levy, Shie Mannor |
| 2024 | ICLR | Learning the Uncertainty Set in Robust Markov Decision Process. | Navdeep Kumar, Kaixin Wang, Uri Gadot, Kfir Yehuda Levy, Shie Mannor |
| 2024 | ICLR | Policy Gradient for Reinforcement Learning with General Utilities. | Navdeep Kumar, Kaixin Wang, Utkarsh Pratiush, Kfir Yehuda Levy, Shie Mannor |
| 2024 | ICLR | Tree Search-Based Policy Optimization under Stochastic Execution Delay. | David Valensi, Esther Derman, Shie Mannor, Gal Dalal |
| 2024 | ICML | Improving Token-Based World Models with Parallel Observation Prediction. | Lior Cohen, Kaixin Wang, Bingyi Kang, Shie Mannor |
| 2024 | ICML | Exploration-Driven Policy Optimization in RLHF: Theoretical Insights on Efficient Data Utilization. | Yihan Du, Anna Winnicki, Gal Dalal, Shie Mannor, R. Srikant |
| 2024 | ICML | Bring Your Own (Non-Robust) Algorithm to Solve Robust MDPs by Estimating The Worst Kernel. | Uri Gadot, Kaixin Wang, Navdeep Kumar, Kfir Yehuda Levy, Shie Mannor |
| 2024 | ICML | Sobolev Space Regularised Pre Density Models. | Mark Kozdoba, Binyamin Perets, Shie Mannor |
| 2024 | ICML | Efficient Value Iteration for s-rectangular Robust Markov Decision Processes. | Navdeep Kumar, Kaixin Wang, Kfir Yehuda Levy, Shie Mannor |
| 2024 | ICML | Prospective Side Information for Latent MDPs. | Jeongyeol Kwon, Yonathan Efroni, Shie Mannor, Constantine Caramanis |
| 2023 | AAAI | Planning and Learning with Adaptive Lookahead. | Aviv Rosenberg, Assaf Hallak, Shie Mannor, Gal Chechik, Gal Dalal |
| 2023 | CCGRID | Implementing Reinforcement Learning Datacenter Congestion Control in NVIDIA NICs. | Benjamin Fuhrer, Yuval Shpigelman, Chen Tessler, Shie Mannor, Gal Chechik, Eitan Zahavi, Gal Dalal |
| 2023 | ICML | Learning to Initiate and Reason in Event-Driven Cascading Processes. | Yuval Atzmon, Eli A. Meirom, Shie Mannor, Gal Chechik |
| 2023 | ICML | Reward-Mixing MDPs with Few Latent Contexts are Learnable. | Jeongyeol Kwon, Yonathan Efroni, Constantine Caramanis, Shie Mannor |
| 2023 | ICML | Representation-Driven Reinforcement Learning. | Ofir Nabati, Guy Tennenholtz, Shie Mannor |
| 2023 | ICML | Learning Hidden Markov Models When the Locations of Missing Observations are Unknown. | Binyamin Perets, Mark Kozdoba, Shie Mannor |
| 2023 | ICML | PPG Reloaded: An Empirical Study on What Matters in Phasic Policy Gradient. | Kaixin Wang, Daquan Zhou, Jiashi Feng, Shie Mannor |
| 2023 | SIGGRAPH | CALM: Conditional Adversarial Latent Models for Directable Virtual Characters. | Chen Tessler, Yoni Kasten, Yunrong Guo, Shie Mannor, Gal Chechik, Xue Bin Peng |
| 2022 | AAAI | Online Apprenticeship Learning. | Lior Shani, Tom Zahavy, Shie Mannor |
| 2022 | AAAI | Reinforcement Learning for Datacenter Congestion Control. | Chen Tessler, Yuval Shpigelman, Gal Dalal, Amit Mandelbaum, Doron Haritan Kazakov, Benjamin Fuhrer, Gal Chechik, Shie Mannor |
| 2022 | AAAI | Locality Matters: A Scalable Value Decomposition Approach for Cooperative Multi-Agent Reinforcement Learning. | Roy Zohar, Shie Mannor, Guy Tennenholtz |
| 2022 | CoRL | DiffStack: A Differentiable and Modular Control Stack for Autonomous Vehicles. | Pter Karkus, Boris Ivanovic, Shie Mannor, Marco Pavone |
| 2022 | ICINCO | Reinforcement Learning for Extended Intelligence. | Shie Mannor |
| 2022 | ICLR | On Covariate Shift of Latent Confounders in Imitation and Reinforcement Learning. | Guy Tennenholtz, Assaf Hallak, Gal Dalal, Shie Mannor, Gal Chechik, Uri Shalit |
| 2022 | ICML | Coordinated Attacks against Contextual Bandits: Fundamental Limits and Defense Mechanisms. | Jeongyeol Kwon, Yonathan Efroni, Constantine Caramanis, Shie Mannor |
| 2022 | ICML | Optimizing Tensor Network Contraction Using Reinforcement Learning. | Eli A. Meirom, Haggai Maron, Shie Mannor, Gal Chechik |
| 2022 | ICML | Analysis of Stochastic Processes through Replay Buffers. | Shirli Di-Castro Shashua, Shie Mannor, Dotan Di Castro |
| 2022 | ICML | The Geometry of Robust Value Functions. | Kaixin Wang, Navdeep Kumar, Kuangqi Zhou, Bryan Hooi, Jiashi Feng, Shie Mannor |
| 2022 | ICML | Actor-Critic based Improper Reinforcement Learning. | Mohammadi Zaki, Avi Mohan, Aditya Gopalan, Shie Mannor |
| 2021 | AAAI | Reinforcement Learning with Trajectory Feedback. | Yonathan Efroni, Nadav Merlis, Shie Mannor |
| 2021 | AAAI | Lenient Regret for Multi-Armed Bandits. | Nadav Merlis, Shie Mannor |
| 2021 | CVPR | Over-the-Air Adversarial Flickering Attacks Against Video Recognition Networks. | Roi Pony, Itay Naeh, Shie Mannor |
| 2021 | ICLR | Acting in Delayed Environments with Non-Stationary Markov Policies. | Esther Derman, Gal Dalal, Shie Mannor |
| 2021 | ICLR | Optimizing Memory Placement using Evolutionary Graph Reinforcement Learning. | Shauharda Khadka, Estelle Aflalo, Mattias Marder, Avrech Ben-David, Santiago Miret, Shie Mannor, Tamir Hazan, Hanlin Tang, Somdeb Majumdar |
| 2021 | ICML | Confidence-Budget Matching for Sequential Budgeted Learning. | Yonathan Efroni, Nadav Merlis, Aadirupa Saha, Shie Mannor |
| 2021 | ICML | Detecting Rewards Deterioration in Episodic Reinforcement Learning. | Ido Greenberg, Shie Mannor |
| 2021 | ICML | Value Iteration in Continuous Actions, States and Time. | Michael Lutter, Shie Mannor, Jan Peters, Dieter Fox, Animesh Garg |
| 2021 | ICML | Controlling Graph Dynamics with Reinforcement Learning and Graph Neural Networks. | Eli A. Meirom, Haggai Maron, Shie Mannor, Gal Chechik |
| 2021 | ICML | Online Limited Memory Neural-Linear Bandits with Likelihood Matching. | Ofir Nabati, Tom Zahavy, Shie Mannor |
| 2021 | UAI | Known unknowns: Learning novel concepts using reasoning-by-elimination. | Harsh Agrawal, Eli A. Meirom, Yuval Atzmon, Shie Mannor, Gal Chechik |
| 2021 | UAI | Action redundancy in reinforcement learning. | Nir Baram, Guy Tennenholtz, Shie Mannor |
| 2021 | UAI | Bandits with partially observable confounded data. | Guy Tennenholtz, Uri Shalit, Shie Mannor, Yonathan Efroni |
| 2020 | AAAI | Adaptive Trust Region Policy Optimization: Global Convergence and Faster Rates for Regularized MDPs. | Lior Shani, Yonathan Efroni, Shie Mannor |
| 2020 | AAAI | Off-Policy Evaluation in Partially Observable Environments. | Guy Tennenholtz, Uri Shalit, Shie Mannor |
| 2020 | ALT | An adaptive stochastic optimization algorithm for resource allocation. | Xavier Fontaine, Shie Mannor, Vianney Perchet |
| 2020 | COLT | Tight Lower Bounds for Combinatorial Multi-Armed Bandits. | Nadav Merlis, Shie Mannor |
| 2020 | ICML | Topic Modeling via Full Dependence Mixtures. | Dan Fisher, Mark Kozdoba, Shie Mannor |
| 2020 | ICML | Optimistic Policy Optimization with Bandit Feedback. | Lior Shani, Yonathan Efroni, Aviv Rosenberg, Shie Mannor |
| 2020 | WACV | Scalable Detection of Offensive and Non-compliant Content / Logo in Product Images. | Shreyansh Gandhi, Samrat Kokkula, Abon Chaudhuri, Alessandro Magnani, Theban Stanley, Behzad Ahmadi, Venkatesh Kandaswamy, Omer Ovenc, Shie Mannor |
| 2019 | AAAI | How to Combine Tree-Search Methods in Reinforcement Learning. | Yonathan Efroni, Gal Dalal, Bruno Scherrer, Shie Mannor |
| 2019 | AAAI | On-Line Learning of Linear Dynamical Systems: Exponential Forgetting in Kalman Filters. | Mark Kozdoba, Jakub Marecek, Tigran T. Tchrakian, Shie Mannor |
| 2019 | COLT | Batch-Size Independent Regret Bounds for the Combinatorial Multi-Armed Bandit Problem. | Nadav Merlis, Shie Mannor |
| 2019 | ICLR | Reward Constrained Policy Optimization. | Chen Tessler, Daniel J. Mankowitz, Shie Mannor |
| 2019 | ICML | Nonlinear Distributional Gradient Temporal-Difference Learning. | Chao Qu, Shie Mannor, Huan Xu |
| 2019 | ICML | Exploration Conscious Reinforcement Learning Revisited. | Lior Shani, Yonathan Efroni, Shie Mannor |
| 2019 | ICML | The Natural Language of Actions. | Guy Tennenholtz, Shie Mannor |
| 2019 | ICML | Action Robust Reinforcement Learning and Applications in Continuous Control. | Chen Tessler, Yonathan Efroni, Shie Mannor |
| 2019 | UAI | A Bayesian Approach to Robust Reinforcement Learning. | Esther Derman, Daniel J. Mankowitz, Timothy A. Mann, Shie Mannor |
| 2018 | AAAI | Finite Sample Analyses for TD(0) With Function Approximation. | Gal Dalal, Balzs Szrnyi, Gugan Thoppe, Shie Mannor |
| 2018 | AAAI | Learning Robust Options. | Daniel J. Mankowitz, Timothy A. Mann, Pierre-Luc Bacon, Doina Precup, Shie Mannor |
| 2018 | AAAI | Is a Picture Worth a Thousand Words? A Deep Multi-Modal Architecture for Product Classification in E-Commerce. | Tom Zahavy, Abhinandan Krishnan, Alessandro Magnani, Shie Mannor |
| 2018 | COLT | A General Approach to Multi-Armed Bandits Under Risk Criteria. | Asaf B. Cassel, Shie Mannor, Assaf Zeevi |
| 2018 | COLT | Finite Sample Analysis of Two-Timescale Stochastic Approximation with Applications to Reinforcement Learning. | Gal Dalal, Gugan Thoppe, Balzs Szrnyi, Shie Mannor |
| 2018 | ICLR | Learning How Not to Act in Text-based Games. | Matan Haroush, Tom Zahavy, Daniel J. Mankowitz, Shie Mannor |
| 2018 | ICLR | Ensemble Robustness and Generalization of Stochastic Deep Learning Algorithms. | Tom Zahavy, Bingyi Kang, Alex Sivak, Jiashi Feng, Huan Xu, Shie Mannor |
| 2018 | ICML | Beyond the One-Step Greedy Approach in Reinforcement Learning. | Yonathan Efroni, Gal Dalal, Bruno Scherrer, Shie Mannor |
| 2018 | ISAIM | PAC Bandits with Risk Constraints. | Yahel David, Balzs Szrnyi, Mohammad Ghavamzadeh, Shie Mannor, Nahum Shimkin |
| 2018 | UAI | Soft-Robust Actor-Critic Policy-Gradient. | Esther Derman, Daniel J. Mankowitz, Timothy A. Mann, Shie Mannor |
| 2017 | AAAI | A Deep Hierarchical Approach to Lifelong Learning in Minecraft. | Chen Tessler, Shahar Givony, Tom Zahavy, Daniel J. Mankowitz, Shie Mannor |
| 2017 | COLT | Ignoring Is a Bliss: Learning with Large Noise Through Reweighting-Minimization. | Daniel Vainsencher, Shie Mannor, Huan Xu |
| 2017 | ICML | End-to-End Differentiable Adversarial Imitation Learning. | Nir Baram, Oron Anschel, Itai Caspi, Shie Mannor |
| 2017 | ICML | Multi-objective Bandits: Optimizing the Generalized Gini Index. | Rbert Busa-Fekete, Balzs Szrnyi, Paul Weng, Shie Mannor |
| 2017 | ICML | Consistent On-Line Off-Policy Evaluation. | Assaf Hallak, Shie Mannor |
| 2017 | IJCAI | Approximate Value Iteration with Temporally Extended Actions (Extended Abstract). | Timothy A. Mann, Shie Mannor, Doina Precup |
| 2017 | WWW | A Nonparametric Sequential Test for Online Randomized Experiments. | Vineet Abhishek, Shie Mannor |
| 2016 | AAAI | Generalized Emphatic Temporal Difference Learning: Bias-Variance Analysis. | Assaf Hallak, Aviv Tamar, Rmi Munos, Shie Mannor |
| 2016 | ICML | Heteroscedastic Sequences: Beyond Gaussianity. | Oren Anava, Shie Mannor |
| 2016 | ICML | Hierarchical Decision Making In Electricity Grid Management. | Gal Dalal, Elad Gilboa, Shie Mannor |
| 2016 | ICML | Graying the black box: Understanding DQNs. | Tom Zahavy, Nir Ben-Zrihem, Shie Mannor |
| 2016 | INFOCOM | Multi-user lax communications: A multi-armed bandit approach. | Orly Avner, Shie Mannor |
| 2015 | AAAI | Learning When to Switch between Skills in a High Dimensional Domain. | Timothy A. Mann, Daniel J. Mankowitz, Shie Mannor |
| 2015 | AAAI | Optimizing the CVaR via Sampling. | Aviv Tamar, Yonatan Glassner, Shie Mannor |
| 2015 | AISTATS | Sensor Selection for Crowdsensing Dynamical Systems. | Franois Schnitzler, Jia Yuan Yu, Shie Mannor |
| 2015 | COLT | Thompson Sampling for Learning Parameterized Markov Decision Processes. | Aditya Gopalan, Shie Mannor |
| 2015 | ICML | Off-policy Model-based Learning under Unknown Factored Dynamics. | Assaf Hallak, Franois Schnitzler, Timothy A. Mann, Shie Mannor |
| 2015 | ICML | Dynamic Sensing: Better Classification under Acquisition Constraints. | Oran Richman, Shie Mannor |
| 2015 | INFOCOM | Formation games of reliable networks. | Eli A. Meirom, Shie Mannor, Ariel Orda |
| 2015 | INFOCOM | Local detection of infections in heterogeneous networks. | Chris Milling, Constantine Caramanis, Shie Mannor, Sanjay Shakkottai |
| 2015 | ISCA | Semantic locality and context-based prefetching using reinforcement learning. | Leeor Peled, Shie Mannor, Uri C. Weiser, Yoav Etsion |
| 2015 | SIGMETRICS | Localized Epidemic Detection in Networks with Overwhelming Noise. | Eli A. Meirom, Chris Milling, Constantine Caramanis, Shie Mannor, Sanjay Shakkottai, Ariel Orda |
| 2014 | COLT | Approachability in unknown games: Online learning meets multi-objective optimization. | Shie Mannor, Vianney Perchet, Gilles Stoltz |
| 2014 | EDBT | Heterogeneous Stream Processing and Crowdsourcing for Urban Traffic Management. | Alexander Artikis, Matthias Weidlich, Franois Schnitzler, Ioannis Boutsis, Thomas Liebig, Nico Piatkowski, Christian Bockermann, Katharina Morik, Vana Kalogeraki, Jakub Marecek, Avigdor Gal, Shie Mannor, Dimitrios Gunopulos, Dermot Kinane |
| 2014 | EDBT | Combining a Gauss-Markov model and Gaussian process for traffic prediction in Dublin city center. | Franois Schnitzler, Thomas Liebig, Shie Mannor, Katharina Morik |
| 2014 | ICML | Thompson Sampling for Complex Online Problems. | Aditya Gopalan, Shie Mannor, Yishay Mansour |
| 2014 | ICML | Concept Drift Detection Through Resampling. | Maayan Harel, Shie Mannor, Ran El-Yaniv, Koby Crammer |
| 2014 | ICML | Latent Bandits. | Odalric-Ambrym Maillard, Shie Mannor |
| 2014 | ICML | Scaling Up Approximate Value Iteration with Options: Better Policies with Fewer Iterations. | Timothy A. Mann, Shie Mannor |
| 2014 | ICML | Time-Regularized Interrupting Options (TRIO). | Timothy A. Mann, Daniel J. Mankowitz, Shie Mannor |
| 2014 | ICML | Scaling Up Robust MDPs using Function Approximation. | Aviv Tamar, Shie Mannor, Huan Xu |
| 2014 | MICRO | Loop-Aware Memory Prefetching Using Code Block Working Sets. | Adi Fuchs, Shie Mannor, Uri C. Weiser, Yoav Etsion |
| 2013 | COLT | Online Learning for Time Series Prediction. | Oren Anava, Elad Hazan, Shie Mannor, Ohad Shamir |
| 2013 | COLT | Opportunistic Strategies for Generalized No-Regret Problems. | Andrey Bernstein, Shie Mannor, Nahum Shimkin |
| 2013 | COLT | Approachability, fast and slow. | Vianney Perchet, Shie Mannor |
| 2013 | ICML | Robust Sparse Regression under Adversarial Corruption. | Yudong Chen, Constantine Caramanis, Shie Mannor |
| 2013 | ICML | Temporal Difference Methods for the Variance of the Reward To Go. | Aviv Tamar, Dotan Di Castro, Shie Mannor |
| 2013 | KDD | Model selection in markovian processes. | Assaf Hallak, Dotan Di Castro, Shie Mannor |
| 2013 | MOBIHOC | Detecting epidemics using highly noisy data. | Chris Milling, Constantine Caramanis, Shie Mannor, Sanjay Shakkottai |
| 2012 | ICML | Decoupling Exploration and Exploitation in Multi-Armed Bandits. | Orly Avner, Shie Mannor, Ohad Shamir |
| 2012 | ICML | Policy Gradients with Variance Related Risk Criteria. | Dotan Di Castro, Aviv Tamar, Shie Mannor |
| 2012 | ICML | Lightning Does Not Strike Twice: Robust MDPs with Coupled Uncertainty. | Shie Mannor, Ofir Mebel, Huan Xu |
| 2012 | SIGMETRICS | Network forensics: random infection vs spreading epidemic. | Chris Milling, Constantine Caramanis, Shie Mannor, Sanjay Shakkottai |
| 2011 | ICML | Learning from Multiple Outlooks. | Maayan Harel, Shie Mannor |
| 2011 | ICML | Mean-Variance Optimization in Markov Decision Processes. | Shie Mannor, John N. Tsitsiklis |
| 2011 | ICML | Bundle Selling by Online Estimation of Valuation Functions. | Daniel Vainsencher, Ofer Dekel, Shie Mannor |
| 2011 | ICML | Unimodal Bandits. | Jia Yuan Yu, Shie Mannor |
| 2011 | IJCAI | Probabilistic Goal Markov Decision Processes. | Huan Xu, Shie Mannor |
| 2011 | INFOCOM | A state action frequency approach to throughput maximization over uncertain wireless channels. | Krishna P. Jagannathan, Shie Mannor, Ishai Menache, Eytan H. Modiano |
| 2010 | AAAI | Activity and Gait Recognition with Time-Delay Embeddings. | Jordan Frank, Shie Mannor, Doina Precup |
| 2010 | COLT | Learning with Global Cost in Stochastic Environments. | Eyal Even-Dar, Shie Mannor, Yishay Mansour |
| 2010 | COLT | Principal Component Analysis with Contaminated Data: The High Dimensional Case. | Huan Xu, Constantine Caramanis, Shie Mannor |
| 2010 | COLT | Robustness and Generalization. | Huan Xu, Shie Mannor |
| 2010 | GLOBECOM | Lowering Error Floors Using Dithered Belief Propagation. | Franois Leduc-Primeau, Saied Hemati, Shie Mannor, Warren J. Gross |
| 2010 | ICDCS | Resource Allocation with Supply Adjustment in Distributed Computing Systems. | Amir Danak, Shie Mannor |
| 2010 | KDD | Generative models for rapid information propagation. | Kirill Dyagilev, Shie Mannor, Elad Yom-Tov |
| 2009 | COLT | Online Learning for Global Cost Functions. | Eyal Even-Dar, Robert Kleinberg, Shie Mannor, Yishay Mansour |
| 2009 | GLOBECOM | A Relaxed Half-Stochastic Iterative Decoder for LDPC Codes. | Franois Leduc-Primeau, Saied Hemati, Warren J. Gross, Shie Mannor |
| 2009 | ICASSP | Tracking Forecast Memories in stochastic decoders. | Saeed Sharifi Tehrani, Ali Naderi, Guy-Armand Kamendje, Shie Mannor, Warren J. Gross |
| 2009 | ICML | Piecewise-stationary bandit problems with side observations. | Jia Yuan Yu, Shie Mannor |
| 2009 | ITW | High dimensional Principal Component Analysis with contaminated data. | Huan Xu, Constantine Caramanis, Shie Mannor |
| 2008 | AAAI | Online Learning with Expert Advice and Finite-Horizon Constraints. | Branislav Kveton, Jia Yuan Yu, Georgios Theocharous, Shie Mannor |
| 2008 | COLT | Learning in the Limit with Adversarial Disturbances. | Constantine Caramanis, Shie Mannor |
| 2008 | ICML | Reinforcement learning in the presence of rare events. | Jordan Frank, Shie Mannor, Doina Precup |
| 2008 | ISAIM | A Lazy Approach to Online Learning with Constraints. | Branislav Kveton, Jia Yuan Yu, Georgios Theocharous, Shie Mannor |
| 2007 | AAAI | Adaptive Timeout Policies for Fast Fine-Grained Power Management. | Branislav Kveton, Prashant Gandhi, Georgios Theocharous, Shie Mannor, Barbara Rosario, Nilesh Shah |
| 2007 | AAAI | User Model and Utility Based Power Management. | Chih-Han Yu, Shie Mannor, Georgios Theocharous, Avi Pfeffer |
| 2007 | COLT | Strategies for Prediction Under Imperfect Monitoring. | Gbor Lugosi, Shie Mannor, Gilles Stoltz |
| 2007 | GLOBECOM | Non-Cooperative Design of Translucent Networks. | Benot Chtelain, Shie Mannor, Franois Gagnon, David V. Plant |
| 2007 | ICML | Percentile optimization in uncertain Markov decision processes with application to efficient exploration. | Erick Delage, Shie Mannor |
| 2007 | Networking | Reinforcement Learning-Based Load Shared Sequential Routing. | Fariba Heidari, Shie Mannor, Lorne Mason |
| 2006 | COLT | Online Learning with Variable Stage Duration. | Shie Mannor, Nahum Shimkin |
| 2006 | COLT | Online Learning with Constraints. | Shie Mannor, John N. Tsitsiklis |
| 2006 | ICML | Automatic basis function construction for approximate dynamic programming and reinforcement learning. | Philipp W. Keller, Shie Mannor, Doina Precup |
| 2006 | INFOCOM | Asymptotics of Efficiency Loss in Competitive Market Mechanisms. | Jia Yuan Yu, Shie Mannor |
| 2005 | ICML | Reinforcement learning with Gaussian processes. | Yaakov Engel, Shie Mannor, Ron Meir |
| 2005 | ICML | The cross entropy method for classification. | Shie Mannor, Dori Peleg, Reuven Y. Rubinstein |
| 2004 | COLT | An Inequality for Nearly Log-Concave Distributions with Applications to Learning. | Constantine Caramanis, Shie Mannor |
| 2004 | COLT | Reinforcement Learning for Average Reward Zero-Sum Games. | Shie Mannor |
| 2004 | ICML | Dynamic abstraction in reinforcement learning via clustering. | Shie Mannor, Ishai Menache, Amit Hoze, Uri Klein |
| 2004 | ICML | Bias and variance in value function estimation. | Shie Mannor, Duncan Simester, Peng Sun, John N. Tsitsiklis |
| 2003 | COLT | On-Line Learning with Imperfect Monitoring. | Shie Mannor, Nahum Shimkin |
| 2003 | COLT | Lower Bounds on the Sample Complexity of Exploration in the Multi-armed Bandit Problem. | Shie Mannor, John N. Tsitsiklis |
| 2003 | ICML | Bayes Meets Bellman: The Gaussian Process Approach to Temporal Difference Learning. | Yaakov Engel, Shie Mannor, Ron Meir |
| 2003 | ICML | Action Elimination and Stopping Conditions for Reinforcement Learning. | Eyal Even-Dar, Shie Mannor, Yishay Mansour |
| 2003 | ICML | The Cross Entropy Method for Fast Policy Search. | Shie Mannor, Reuven Y. Rubinstein, Yohai Gat |
| 2002 | COLT | PAC Bounds for Multi-armed Bandit and Markov Decision Processes. | Eyal Even-Dar, Shie Mannor, Yishay Mansour |
| 2002 | COLT | The Consistency of Greedy Algorithms for Classification. | Shie Mannor, Ron Meir, Tong Zhang |
| 2001 | COLT | Geometric Bounds for Generalization in Boosting. | Shie Mannor, Ron Meir |
| 2001 | COLT | Adaptive Strategies and Regret Minimization in Arbitrarily Varying Markov Environments. | Shie Mannor, Nahum Shimkin |
| 2001 | ICML | Learning Embedded Maps of Markov Processes. | Yaakov Engel, Shie Mannor |