Skip to content

Shie Mannor

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

168

Venues

29

Active years

2001–2025

Best venue rank

A*

Where they publish

Papers

168 indexed papers, newest first.

YearVenueTitleAuthors
2025CVPRRL-RC-DoT: A Block-level RL agent for Task-Aware Video Compression.Uri Gadot, Assaf Shocher, Shie Mannor, Gal Chechik, Assaf Hallak
2025ICLRGlobal Convergence of Policy Gradient in Average Reward MDPs.Navdeep Kumar, Yashaswini Murthy, Itai Shufaro, Kfir Yehuda Levy, R. Srikant, Shie Mannor
2025ICLROn Bits and Bandits: Quantifying the Regret-Information Trade-off.Itai Shufaro, Nadav Merlis, Nir Weinberger, Shie Mannor
2025ICMLPolicy Gradient with Tree Expansion.Gal Dalal, Assaf Hallak, Gugan Thoppe, Shie Mannor, Gal Chechik
2025ICMLReinforcement Learning with Segment Feedback.Yihan Du, Anna Winnicki, Gal Dalal, Shie Mannor, R. Srikant
2025ICMLA Classification View on Meta Learning Bandits.Mirco Mutti, Jeongyeol Kwon, Shie Mannor, Aviv Tamar
2024AAAISolving Non-rectangular Reward-Robust MDPs via Frequency Regularization.Uri Gadot, Esther Derman, Navdeep Kumar, Maxence Mohamed Elfatihi, Kfir Levy, Shie Mannor
2024ECCVPlaMo: Plan and Move in Rich 3D Physical Environments.Assaf Hallak, Gal Dalal, Chen Tessler, Kelly Guo, Shie Mannor, Gal Chechik
2024ICLRPolicy Gradient with Tree Search (PGTS) in Reinforcement Learning Evades Local Maxima.Navdeep Kumar, Priyank Agrawal, Kfir Yehuda Levy, Shie Mannor
2024ICLRTowards Faster Global Convergence of Robust Policy Gradient Methods.Navdeep Kumar, Ilnura Usmanova, Kfir Yehuda Levy, Shie Mannor
2024ICLRLearning the Uncertainty Set in Robust Markov Decision Process.Navdeep Kumar, Kaixin Wang, Uri Gadot, Kfir Yehuda Levy, Shie Mannor
2024ICLRPolicy Gradient for Reinforcement Learning with General Utilities.Navdeep Kumar, Kaixin Wang, Utkarsh Pratiush, Kfir Yehuda Levy, Shie Mannor
2024ICLRTree Search-Based Policy Optimization under Stochastic Execution Delay.David Valensi, Esther Derman, Shie Mannor, Gal Dalal
2024ICMLImproving Token-Based World Models with Parallel Observation Prediction.Lior Cohen, Kaixin Wang, Bingyi Kang, Shie Mannor
2024ICMLExploration-Driven Policy Optimization in RLHF: Theoretical Insights on Efficient Data Utilization.Yihan Du, Anna Winnicki, Gal Dalal, Shie Mannor, R. Srikant
2024ICMLBring Your Own (Non-Robust) Algorithm to Solve Robust MDPs by Estimating The Worst Kernel.Uri Gadot, Kaixin Wang, Navdeep Kumar, Kfir Yehuda Levy, Shie Mannor
2024ICMLSobolev Space Regularised Pre Density Models.Mark Kozdoba, Binyamin Perets, Shie Mannor
2024ICMLEfficient Value Iteration for s-rectangular Robust Markov Decision Processes.Navdeep Kumar, Kaixin Wang, Kfir Yehuda Levy, Shie Mannor
2024ICMLProspective Side Information for Latent MDPs.Jeongyeol Kwon, Yonathan Efroni, Shie Mannor, Constantine Caramanis
2023AAAIPlanning and Learning with Adaptive Lookahead.Aviv Rosenberg, Assaf Hallak, Shie Mannor, Gal Chechik, Gal Dalal
2023CCGRIDImplementing Reinforcement Learning Datacenter Congestion Control in NVIDIA NICs.Benjamin Fuhrer, Yuval Shpigelman, Chen Tessler, Shie Mannor, Gal Chechik, Eitan Zahavi, Gal Dalal
2023ICMLLearning to Initiate and Reason in Event-Driven Cascading Processes.Yuval Atzmon, Eli A. Meirom, Shie Mannor, Gal Chechik
2023ICMLReward-Mixing MDPs with Few Latent Contexts are Learnable.Jeongyeol Kwon, Yonathan Efroni, Constantine Caramanis, Shie Mannor
2023ICMLRepresentation-Driven Reinforcement Learning.Ofir Nabati, Guy Tennenholtz, Shie Mannor
2023ICMLLearning Hidden Markov Models When the Locations of Missing Observations are Unknown.Binyamin Perets, Mark Kozdoba, Shie Mannor
2023ICMLPPG Reloaded: An Empirical Study on What Matters in Phasic Policy Gradient.Kaixin Wang, Daquan Zhou, Jiashi Feng, Shie Mannor
2023SIGGRAPHCALM: Conditional Adversarial Latent Models for Directable Virtual Characters.Chen Tessler, Yoni Kasten, Yunrong Guo, Shie Mannor, Gal Chechik, Xue Bin Peng
2022AAAIOnline Apprenticeship Learning.Lior Shani, Tom Zahavy, Shie Mannor
2022AAAIReinforcement Learning for Datacenter Congestion Control.Chen Tessler, Yuval Shpigelman, Gal Dalal, Amit Mandelbaum, Doron Haritan Kazakov, Benjamin Fuhrer, Gal Chechik, Shie Mannor
2022AAAILocality Matters: A Scalable Value Decomposition Approach for Cooperative Multi-Agent Reinforcement Learning.Roy Zohar, Shie Mannor, Guy Tennenholtz
2022CoRLDiffStack: A Differentiable and Modular Control Stack for Autonomous Vehicles.Pter Karkus, Boris Ivanovic, Shie Mannor, Marco Pavone
2022ICINCOReinforcement Learning for Extended Intelligence.Shie Mannor
2022ICLROn Covariate Shift of Latent Confounders in Imitation and Reinforcement Learning.Guy Tennenholtz, Assaf Hallak, Gal Dalal, Shie Mannor, Gal Chechik, Uri Shalit
2022ICMLCoordinated Attacks against Contextual Bandits: Fundamental Limits and Defense Mechanisms.Jeongyeol Kwon, Yonathan Efroni, Constantine Caramanis, Shie Mannor
2022ICMLOptimizing Tensor Network Contraction Using Reinforcement Learning.Eli A. Meirom, Haggai Maron, Shie Mannor, Gal Chechik
2022ICMLAnalysis of Stochastic Processes through Replay Buffers.Shirli Di-Castro Shashua, Shie Mannor, Dotan Di Castro
2022ICMLThe Geometry of Robust Value Functions.Kaixin Wang, Navdeep Kumar, Kuangqi Zhou, Bryan Hooi, Jiashi Feng, Shie Mannor
2022ICMLActor-Critic based Improper Reinforcement Learning.Mohammadi Zaki, Avi Mohan, Aditya Gopalan, Shie Mannor
2021AAAIReinforcement Learning with Trajectory Feedback.Yonathan Efroni, Nadav Merlis, Shie Mannor
2021AAAILenient Regret for Multi-Armed Bandits.Nadav Merlis, Shie Mannor
2021CVPROver-the-Air Adversarial Flickering Attacks Against Video Recognition Networks.Roi Pony, Itay Naeh, Shie Mannor
2021ICLRActing in Delayed Environments with Non-Stationary Markov Policies.Esther Derman, Gal Dalal, Shie Mannor
2021ICLROptimizing Memory Placement using Evolutionary Graph Reinforcement Learning.Shauharda Khadka, Estelle Aflalo, Mattias Marder, Avrech Ben-David, Santiago Miret, Shie Mannor, Tamir Hazan, Hanlin Tang, Somdeb Majumdar
2021ICMLConfidence-Budget Matching for Sequential Budgeted Learning.Yonathan Efroni, Nadav Merlis, Aadirupa Saha, Shie Mannor
2021ICMLDetecting Rewards Deterioration in Episodic Reinforcement Learning.Ido Greenberg, Shie Mannor
2021ICMLValue Iteration in Continuous Actions, States and Time.Michael Lutter, Shie Mannor, Jan Peters, Dieter Fox, Animesh Garg
2021ICMLControlling Graph Dynamics with Reinforcement Learning and Graph Neural Networks.Eli A. Meirom, Haggai Maron, Shie Mannor, Gal Chechik
2021ICMLOnline Limited Memory Neural-Linear Bandits with Likelihood Matching.Ofir Nabati, Tom Zahavy, Shie Mannor
2021UAIKnown unknowns: Learning novel concepts using reasoning-by-elimination.Harsh Agrawal, Eli A. Meirom, Yuval Atzmon, Shie Mannor, Gal Chechik
2021UAIAction redundancy in reinforcement learning.Nir Baram, Guy Tennenholtz, Shie Mannor
2021UAIBandits with partially observable confounded data.Guy Tennenholtz, Uri Shalit, Shie Mannor, Yonathan Efroni
2020AAAIAdaptive Trust Region Policy Optimization: Global Convergence and Faster Rates for Regularized MDPs.Lior Shani, Yonathan Efroni, Shie Mannor
2020AAAIOff-Policy Evaluation in Partially Observable Environments.Guy Tennenholtz, Uri Shalit, Shie Mannor
2020ALTAn adaptive stochastic optimization algorithm for resource allocation.Xavier Fontaine, Shie Mannor, Vianney Perchet
2020COLTTight Lower Bounds for Combinatorial Multi-Armed Bandits.Nadav Merlis, Shie Mannor
2020ICMLTopic Modeling via Full Dependence Mixtures.Dan Fisher, Mark Kozdoba, Shie Mannor
2020ICMLOptimistic Policy Optimization with Bandit Feedback.Lior Shani, Yonathan Efroni, Aviv Rosenberg, Shie Mannor
2020WACVScalable Detection of Offensive and Non-compliant Content / Logo in Product Images.Shreyansh Gandhi, Samrat Kokkula, Abon Chaudhuri, Alessandro Magnani, Theban Stanley, Behzad Ahmadi, Venkatesh Kandaswamy, Omer Ovenc, Shie Mannor
2019AAAIHow to Combine Tree-Search Methods in Reinforcement Learning.Yonathan Efroni, Gal Dalal, Bruno Scherrer, Shie Mannor
2019AAAIOn-Line Learning of Linear Dynamical Systems: Exponential Forgetting in Kalman Filters.Mark Kozdoba, Jakub Marecek, Tigran T. Tchrakian, Shie Mannor
2019COLTBatch-Size Independent Regret Bounds for the Combinatorial Multi-Armed Bandit Problem.Nadav Merlis, Shie Mannor
2019ICLRReward Constrained Policy Optimization.Chen Tessler, Daniel J. Mankowitz, Shie Mannor
2019ICMLNonlinear Distributional Gradient Temporal-Difference Learning.Chao Qu, Shie Mannor, Huan Xu
2019ICMLExploration Conscious Reinforcement Learning Revisited.Lior Shani, Yonathan Efroni, Shie Mannor
2019ICMLThe Natural Language of Actions.Guy Tennenholtz, Shie Mannor
2019ICMLAction Robust Reinforcement Learning and Applications in Continuous Control.Chen Tessler, Yonathan Efroni, Shie Mannor
2019UAIA Bayesian Approach to Robust Reinforcement Learning.Esther Derman, Daniel J. Mankowitz, Timothy A. Mann, Shie Mannor
2018AAAIFinite Sample Analyses for TD(0) With Function Approximation.Gal Dalal, Balzs Szrnyi, Gugan Thoppe, Shie Mannor
2018AAAILearning Robust Options.Daniel J. Mankowitz, Timothy A. Mann, Pierre-Luc Bacon, Doina Precup, Shie Mannor
2018AAAIIs a Picture Worth a Thousand Words? A Deep Multi-Modal Architecture for Product Classification in E-Commerce.Tom Zahavy, Abhinandan Krishnan, Alessandro Magnani, Shie Mannor
2018COLTA General Approach to Multi-Armed Bandits Under Risk Criteria.Asaf B. Cassel, Shie Mannor, Assaf Zeevi
2018COLTFinite Sample Analysis of Two-Timescale Stochastic Approximation with Applications to Reinforcement Learning.Gal Dalal, Gugan Thoppe, Balzs Szrnyi, Shie Mannor
2018ICLRLearning How Not to Act in Text-based Games.Matan Haroush, Tom Zahavy, Daniel J. Mankowitz, Shie Mannor
2018ICLREnsemble Robustness and Generalization of Stochastic Deep Learning Algorithms.Tom Zahavy, Bingyi Kang, Alex Sivak, Jiashi Feng, Huan Xu, Shie Mannor
2018ICMLBeyond the One-Step Greedy Approach in Reinforcement Learning.Yonathan Efroni, Gal Dalal, Bruno Scherrer, Shie Mannor
2018ISAIMPAC Bandits with Risk Constraints.Yahel David, Balzs Szrnyi, Mohammad Ghavamzadeh, Shie Mannor, Nahum Shimkin
2018UAISoft-Robust Actor-Critic Policy-Gradient.Esther Derman, Daniel J. Mankowitz, Timothy A. Mann, Shie Mannor
2017AAAIA Deep Hierarchical Approach to Lifelong Learning in Minecraft.Chen Tessler, Shahar Givony, Tom Zahavy, Daniel J. Mankowitz, Shie Mannor
2017COLTIgnoring Is a Bliss: Learning with Large Noise Through Reweighting-Minimization.Daniel Vainsencher, Shie Mannor, Huan Xu
2017ICMLEnd-to-End Differentiable Adversarial Imitation Learning.Nir Baram, Oron Anschel, Itai Caspi, Shie Mannor
2017ICMLMulti-objective Bandits: Optimizing the Generalized Gini Index.Rbert Busa-Fekete, Balzs Szrnyi, Paul Weng, Shie Mannor
2017ICMLConsistent On-Line Off-Policy Evaluation.Assaf Hallak, Shie Mannor
2017IJCAIApproximate Value Iteration with Temporally Extended Actions (Extended Abstract).Timothy A. Mann, Shie Mannor, Doina Precup
2017WWWA Nonparametric Sequential Test for Online Randomized Experiments.Vineet Abhishek, Shie Mannor
2016AAAIGeneralized Emphatic Temporal Difference Learning: Bias-Variance Analysis.Assaf Hallak, Aviv Tamar, Rmi Munos, Shie Mannor
2016ICMLHeteroscedastic Sequences: Beyond Gaussianity.Oren Anava, Shie Mannor
2016ICMLHierarchical Decision Making In Electricity Grid Management.Gal Dalal, Elad Gilboa, Shie Mannor
2016ICMLGraying the black box: Understanding DQNs.Tom Zahavy, Nir Ben-Zrihem, Shie Mannor
2016INFOCOMMulti-user lax communications: A multi-armed bandit approach.Orly Avner, Shie Mannor
2015AAAILearning When to Switch between Skills in a High Dimensional Domain.Timothy A. Mann, Daniel J. Mankowitz, Shie Mannor
2015AAAIOptimizing the CVaR via Sampling.Aviv Tamar, Yonatan Glassner, Shie Mannor
2015AISTATSSensor Selection for Crowdsensing Dynamical Systems.Franois Schnitzler, Jia Yuan Yu, Shie Mannor
2015COLTThompson Sampling for Learning Parameterized Markov Decision Processes.Aditya Gopalan, Shie Mannor
2015ICMLOff-policy Model-based Learning under Unknown Factored Dynamics.Assaf Hallak, Franois Schnitzler, Timothy A. Mann, Shie Mannor
2015ICMLDynamic Sensing: Better Classification under Acquisition Constraints.Oran Richman, Shie Mannor
2015INFOCOMFormation games of reliable networks.Eli A. Meirom, Shie Mannor, Ariel Orda
2015INFOCOMLocal detection of infections in heterogeneous networks.Chris Milling, Constantine Caramanis, Shie Mannor, Sanjay Shakkottai
2015ISCASemantic locality and context-based prefetching using reinforcement learning.Leeor Peled, Shie Mannor, Uri C. Weiser, Yoav Etsion
2015SIGMETRICSLocalized Epidemic Detection in Networks with Overwhelming Noise.Eli A. Meirom, Chris Milling, Constantine Caramanis, Shie Mannor, Sanjay Shakkottai, Ariel Orda
2014COLTApproachability in unknown games: Online learning meets multi-objective optimization.Shie Mannor, Vianney Perchet, Gilles Stoltz
2014EDBTHeterogeneous Stream Processing and Crowdsourcing for Urban Traffic Management.Alexander Artikis, Matthias Weidlich, Franois Schnitzler, Ioannis Boutsis, Thomas Liebig, Nico Piatkowski, Christian Bockermann, Katharina Morik, Vana Kalogeraki, Jakub Marecek, Avigdor Gal, Shie Mannor, Dimitrios Gunopulos, Dermot Kinane
2014EDBTCombining a Gauss-Markov model and Gaussian process for traffic prediction in Dublin city center.Franois Schnitzler, Thomas Liebig, Shie Mannor, Katharina Morik
2014ICMLThompson Sampling for Complex Online Problems.Aditya Gopalan, Shie Mannor, Yishay Mansour
2014ICMLConcept Drift Detection Through Resampling.Maayan Harel, Shie Mannor, Ran El-Yaniv, Koby Crammer
2014ICMLLatent Bandits.Odalric-Ambrym Maillard, Shie Mannor
2014ICMLScaling Up Approximate Value Iteration with Options: Better Policies with Fewer Iterations.Timothy A. Mann, Shie Mannor
2014ICMLTime-Regularized Interrupting Options (TRIO).Timothy A. Mann, Daniel J. Mankowitz, Shie Mannor
2014ICMLScaling Up Robust MDPs using Function Approximation.Aviv Tamar, Shie Mannor, Huan Xu
2014MICROLoop-Aware Memory Prefetching Using Code Block Working Sets.Adi Fuchs, Shie Mannor, Uri C. Weiser, Yoav Etsion
2013COLTOnline Learning for Time Series Prediction.Oren Anava, Elad Hazan, Shie Mannor, Ohad Shamir
2013COLTOpportunistic Strategies for Generalized No-Regret Problems.Andrey Bernstein, Shie Mannor, Nahum Shimkin
2013COLTApproachability, fast and slow.Vianney Perchet, Shie Mannor
2013ICMLRobust Sparse Regression under Adversarial Corruption.Yudong Chen, Constantine Caramanis, Shie Mannor
2013ICMLTemporal Difference Methods for the Variance of the Reward To Go.Aviv Tamar, Dotan Di Castro, Shie Mannor
2013KDDModel selection in markovian processes.Assaf Hallak, Dotan Di Castro, Shie Mannor
2013MOBIHOCDetecting epidemics using highly noisy data.Chris Milling, Constantine Caramanis, Shie Mannor, Sanjay Shakkottai
2012ICMLDecoupling Exploration and Exploitation in Multi-Armed Bandits.Orly Avner, Shie Mannor, Ohad Shamir
2012ICMLPolicy Gradients with Variance Related Risk Criteria.Dotan Di Castro, Aviv Tamar, Shie Mannor
2012ICMLLightning Does Not Strike Twice: Robust MDPs with Coupled Uncertainty.Shie Mannor, Ofir Mebel, Huan Xu
2012SIGMETRICSNetwork forensics: random infection vs spreading epidemic.Chris Milling, Constantine Caramanis, Shie Mannor, Sanjay Shakkottai
2011ICMLLearning from Multiple Outlooks.Maayan Harel, Shie Mannor
2011ICMLMean-Variance Optimization in Markov Decision Processes.Shie Mannor, John N. Tsitsiklis
2011ICMLBundle Selling by Online Estimation of Valuation Functions.Daniel Vainsencher, Ofer Dekel, Shie Mannor
2011ICMLUnimodal Bandits.Jia Yuan Yu, Shie Mannor
2011IJCAIProbabilistic Goal Markov Decision Processes.Huan Xu, Shie Mannor
2011INFOCOMA state action frequency approach to throughput maximization over uncertain wireless channels.Krishna P. Jagannathan, Shie Mannor, Ishai Menache, Eytan H. Modiano
2010AAAIActivity and Gait Recognition with Time-Delay Embeddings.Jordan Frank, Shie Mannor, Doina Precup
2010COLTLearning with Global Cost in Stochastic Environments.Eyal Even-Dar, Shie Mannor, Yishay Mansour
2010COLTPrincipal Component Analysis with Contaminated Data: The High Dimensional Case.Huan Xu, Constantine Caramanis, Shie Mannor
2010COLTRobustness and Generalization.Huan Xu, Shie Mannor
2010GLOBECOMLowering Error Floors Using Dithered Belief Propagation.Franois Leduc-Primeau, Saied Hemati, Shie Mannor, Warren J. Gross
2010ICDCSResource Allocation with Supply Adjustment in Distributed Computing Systems.Amir Danak, Shie Mannor
2010KDDGenerative models for rapid information propagation.Kirill Dyagilev, Shie Mannor, Elad Yom-Tov
2009COLTOnline Learning for Global Cost Functions.Eyal Even-Dar, Robert Kleinberg, Shie Mannor, Yishay Mansour
2009GLOBECOMA Relaxed Half-Stochastic Iterative Decoder for LDPC Codes.Franois Leduc-Primeau, Saied Hemati, Warren J. Gross, Shie Mannor
2009ICASSPTracking Forecast Memories in stochastic decoders.Saeed Sharifi Tehrani, Ali Naderi, Guy-Armand Kamendje, Shie Mannor, Warren J. Gross
2009ICMLPiecewise-stationary bandit problems with side observations.Jia Yuan Yu, Shie Mannor
2009ITWHigh dimensional Principal Component Analysis with contaminated data.Huan Xu, Constantine Caramanis, Shie Mannor
2008AAAIOnline Learning with Expert Advice and Finite-Horizon Constraints.Branislav Kveton, Jia Yuan Yu, Georgios Theocharous, Shie Mannor
2008COLTLearning in the Limit with Adversarial Disturbances.Constantine Caramanis, Shie Mannor
2008ICMLReinforcement learning in the presence of rare events.Jordan Frank, Shie Mannor, Doina Precup
2008ISAIMA Lazy Approach to Online Learning with Constraints.Branislav Kveton, Jia Yuan Yu, Georgios Theocharous, Shie Mannor
2007AAAIAdaptive Timeout Policies for Fast Fine-Grained Power Management.Branislav Kveton, Prashant Gandhi, Georgios Theocharous, Shie Mannor, Barbara Rosario, Nilesh Shah
2007AAAIUser Model and Utility Based Power Management.Chih-Han Yu, Shie Mannor, Georgios Theocharous, Avi Pfeffer
2007COLTStrategies for Prediction Under Imperfect Monitoring.Gbor Lugosi, Shie Mannor, Gilles Stoltz
2007GLOBECOMNon-Cooperative Design of Translucent Networks.Benot Chtelain, Shie Mannor, Franois Gagnon, David V. Plant
2007ICMLPercentile optimization in uncertain Markov decision processes with application to efficient exploration.Erick Delage, Shie Mannor
2007NetworkingReinforcement Learning-Based Load Shared Sequential Routing.Fariba Heidari, Shie Mannor, Lorne Mason
2006COLTOnline Learning with Variable Stage Duration.Shie Mannor, Nahum Shimkin
2006COLTOnline Learning with Constraints.Shie Mannor, John N. Tsitsiklis
2006ICMLAutomatic basis function construction for approximate dynamic programming and reinforcement learning.Philipp W. Keller, Shie Mannor, Doina Precup
2006INFOCOMAsymptotics of Efficiency Loss in Competitive Market Mechanisms.Jia Yuan Yu, Shie Mannor
2005ICMLReinforcement learning with Gaussian processes.Yaakov Engel, Shie Mannor, Ron Meir
2005ICMLThe cross entropy method for classification.Shie Mannor, Dori Peleg, Reuven Y. Rubinstein
2004COLTAn Inequality for Nearly Log-Concave Distributions with Applications to Learning.Constantine Caramanis, Shie Mannor
2004COLTReinforcement Learning for Average Reward Zero-Sum Games.Shie Mannor
2004ICMLDynamic abstraction in reinforcement learning via clustering.Shie Mannor, Ishai Menache, Amit Hoze, Uri Klein
2004ICMLBias and variance in value function estimation.Shie Mannor, Duncan Simester, Peng Sun, John N. Tsitsiklis
2003COLTOn-Line Learning with Imperfect Monitoring.Shie Mannor, Nahum Shimkin
2003COLTLower Bounds on the Sample Complexity of Exploration in the Multi-armed Bandit Problem.Shie Mannor, John N. Tsitsiklis
2003ICMLBayes Meets Bellman: The Gaussian Process Approach to Temporal Difference Learning.Yaakov Engel, Shie Mannor, Ron Meir
2003ICMLAction Elimination and Stopping Conditions for Reinforcement Learning.Eyal Even-Dar, Shie Mannor, Yishay Mansour
2003ICMLThe Cross Entropy Method for Fast Policy Search.Shie Mannor, Reuven Y. Rubinstein, Yohai Gat
2002COLTPAC Bounds for Multi-armed Bandit and Markov Decision Processes.Eyal Even-Dar, Shie Mannor, Yishay Mansour
2002COLTThe Consistency of Greedy Algorithms for Classification.Shie Mannor, Ron Meir, Tong Zhang
2001COLTGeometric Bounds for Generalization in Boosting.Shie Mannor, Ron Meir
2001COLTAdaptive Strategies and Regret Minimization in Arbitrarily Varying Markov Environments.Shie Mannor, Nahum Shimkin
2001ICMLLearning Embedded Maps of Markov Processes.Yaakov Engel, Shie Mannor