Abbas Abdolmaleki
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
28
Venues
10
Active years
2011–2025
Best venue rank
A*
Where they publish
Papers
28 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ICLR | Learning from negative feedback, or positive feedback or both. | Abbas Abdolmaleki, Bilal Piot, Bobak Shahriari, Jost Tobias Springenberg, Tim Hertweck, Michael Bloesch, Rishabh Joshi, Thomas Lampe, Junhyuk Oh, Nicolas Heess, Jonas Buchli, Martin A. Riedmiller |
| 2024 | ICML | Offline Actor-Critic Reinforcement Learning Scales to Large Models. | Jost Tobias Springenberg, Abbas Abdolmaleki, Jingwei Zhang, Oliver Groth, Michael Bloesch, Thomas Lampe, Philemon Brakel, Sarah Bechtle, Steven Kapturowski, Roland Hafner, Nicolas Heess, Martin A. Riedmiller |
| 2024 | ICRA | Mastering Stacking of Diverse Shapes with Large-Scale Iterative Reinforcement Learning on Real Robots. | Thomas Lampe, Abbas Abdolmaleki, Sarah Bechtle, Sandy H. Huang, Jost Tobias Springenberg, Michael Bloesch, Oliver Groth, Roland Hafner, Tim Hertweck, Michael Neunert, Markus Wulfmeier, Jingwei Zhang, Francesco Nori, Nicolas Heess, Martin A. Riedmiller |
| 2022 | ICLR | Evaluating Model-Based Planning and Planner Amortization for Continuous Control. | Arunkumar Byravan, Leonard Hasenclever, Piotr Trochim, Mehdi Mirza, Alessandro Davide Ialongo, Yuval Tassa, Jost Tobias Springenberg, Abbas Abdolmaleki, Nicolas Heess, Josh Merel, Martin A. Riedmiller |
| 2022 | IROS | How to Spend Your Robot Time: Bridging Kickstarting and Offline Reinforcement Learning for Vision-based Robotic Manipulation. | Alex X. Lee, Coline Devin, Jost Tobias Springenberg, Yuxiang Zhou, Thomas Lampe, Abbas Abdolmaleki, Konstantinos Bousmalis |
| 2021 | CoRL | A Constrained Multi-Objective Reinforcement Learning Framework. | Sandy H. Huang, Abbas Abdolmaleki, Giulia Vezzani, Philemon Brakel, Daniel J. Mankowitz, Michael Neunert, Steven Bohez, Yuval Tassa, Nicolas Heess, Martin A. Riedmiller, Raia Hadsell |
| 2021 | CoRL | Beyond Pick-and-Place: Tackling Robotic Stacking of Diverse Shapes. | Alex X. Lee, Coline Manon Devin, Yuxiang Zhou, Thomas Lampe, Konstantinos Bousmalis, Jost Tobias Springenberg, Arunkumar Byravan, Abbas Abdolmaleki, Nimrod Gileadi, David Khosid, Claudio Fantacci, Jos Enrique Chen, Akhil Raju, Rae Jeong, Michael Neunert, Antoine Laurens, Stefano Saliceti, Federico Casarini, Martin A. Riedmiller, Raia Hadsell, Francesco Nori |
| 2021 | ICML | Data-efficient Hindsight Off-policy Option Learning. | Markus Wulfmeier, Dushyant Rao, Roland Hafner, Thomas Lampe, Abbas Abdolmaleki, Tim Hertweck, Michael Neunert, Dhruva Tirumala, Noah Y. Siegel, Nicolas Heess, Martin A. Riedmiller |
| 2020 | ICLR | Robust Reinforcement Learning for Continuous Control with Model Misspecification. | Daniel J. Mankowitz, Nir Levine, Rae Jeong, Abbas Abdolmaleki, Jost Tobias Springenberg, Yuanyuan Shi, Jackie Kay, Todd Hester, Timothy A. Mann, Martin A. Riedmiller |
| 2020 | ICLR | Keep Doing What Worked: Behavior Modelling Priors for Offline Reinforcement Learning. | Noah Y. Siegel, Jost Tobias Springenberg, Felix Berkenkamp, Abbas Abdolmaleki, Michael Neunert, Thomas Lampe, Roland Hafner, Nicolas Heess, Martin A. Riedmiller |
| 2020 | ICLR | V-MPO: On-Policy Maximum a Posteriori Policy Optimization for Discrete and Continuous Control. | H. Francis Song, Abbas Abdolmaleki, Jost Tobias Springenberg, Aidan Clark, Hubert Soyer, Jack W. Rae, Seb Noury, Arun Ahuja, Siqi Liu, Dhruva Tirumala, Nicolas Heess, Dan Belov, Martin A. Riedmiller, Matthew M. Botvinick |
| 2020 | ICML | A distributional view on multi-objective policy optimization. | Abbas Abdolmaleki, Sandy H. Huang, Leonard Hasenclever, Michael Neunert, H. Francis Song, Martina Zambelli, Murilo F. Martins, Nicolas Heess, Raia Hadsell, Martin A. Riedmiller |
| 2019 | CoRL | Imagined Value Gradients: Model-Based Policy Optimization with Tranferable Latent Dynamics Models. | Arunkumar Byravan, Jost Tobias Springenberg, Abbas Abdolmaleki, Roland Hafner, Michael Neunert, Thomas Lampe, Noah Y. Siegel, Nicolas Heess, Martin A. Riedmiller |
| 2019 | CoRL | Continuous-Discrete Reinforcement Learning for Hybrid Control in Robotics. | Michael Neunert, Abbas Abdolmaleki, Markus Wulfmeier, Thomas Lampe, Jost Tobias Springenberg, Roland Hafner, Francesco Romano, Jonas Buchli, Nicolas Heess, Martin A. Riedmiller |
| 2018 | ICLR | Maximum a Posteriori Policy Optimisation. | Abbas Abdolmaleki, Jost Tobias Springenberg, Yuval Tassa, Rmi Munos, Nicolas Heess, Martin A. Riedmiller |
| 2018 | ICLR | Guide Actor-Critic for Continuous Control. | Voot Tangkaratt, Abbas Abdolmaleki, Masashi Sugiyama |
| 2018 | ICRA | Eager and Memory-Based Non-Parametric Stochastic Search Methods for Learning Control. | Victor Barbaros, Herke van Hoof, Abbas Abdolmaleki, David Meger |
| 2017 | AAAI | Stochastic Search In Changing Situations. | Abbas Abdolmaleki, David Simes, Nuno Lau, Lus Paulo Reis, Bob Price, Gerhard Neumann |
| 2017 | GECCO | Deriving and improving CMA-ES with information geometric trust regions. | Abbas Abdolmaleki, Bob Price, Nuno Lau, Lus Paulo Reis, Gerhard Neumann |
| 2017 | IJCAI | Contextual Covariance Matrix Adaptation Evolutionary Strategies. | Abbas Abdolmaleki, Bob Price, Nuno Lau, Lus Paulo Reis, Gerhard Neumann |
| 2016 | GECCO | Model-Based Relative Entropy Stochastic Search. | Abbas Abdolmaleki, Rudolf Lioutikov, Nuno Lau, Lus Paulo Reis, Jan Peters, Gerhard Neumann |
| 2016 | GECCO | Contextual Stochastic Search. | Abbas Abdolmaleki, Nuno Lau, Lus Paulo Reis, Gerhard Neumann |
| 2016 | ICML | Model-Free Trajectory Optimization for Reinforcement Learning. | Riad Akrour, Gerhard Neumann, Hany Abdulsamad, Abbas Abdolmaleki |
| 2016 | IROS | Non-parametric contextual stochastic search. | Abbas Abdolmaleki, Nuno Lau, Lus Paulo Reis, Gerhard Neumann |
| 2016 | RoboCup | Learning a Humanoid Kick with Controlled Distance. | Abbas Abdolmaleki, David Simes, Nuno Lau, Lus Paulo Reis, Gerhard Neumann |
| 2013 | EPIA | Omnidirectional Walking and Active Balance for Soccer Humanoid Robot. | Nima Shafii, Abbas Abdolmaleki, Rui Ferreira, Nuno Lau, Lus Paulo Reis |
| 2012 | RoboCup | A Distributed Cooperative Reinforcement Learning Method for Decision Making in Fire Brigade Teams. | Abbas Abdolmaleki, Mostafa Movahedi, Nuno Lau, Lus Paulo Reis |
| 2011 | EPIA | A Reinforcement Learning Based Method for Optimizing the Process of Decision Making in Fire Brigade Agents. | Abbas Abdolmaleki, Mostafa Movahedi, Sajjad Salehi, Nuno Lau, Lus Paulo Reis |