Skip to content

Sandy H. Huang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

13

Venues

7

Active years

2014–2024

Best venue rank

A*

Where they publish

Papers

13 indexed papers, newest first.

YearVenueTitleAuthors
2024CoRLLearning Robot Soccer from Egocentric Vision with Deep Reinforcement Learning.Dhruva Tirumala, Markus Wulfmeier, Ben Moran, Sandy H. Huang, Jan Humplik, Guy Lever, Tuomas Haarnoja, Leonard Hasenclever, Arunkumar Byravan, Nathan Batchelor, Neil Sreendra, Kushal Patel, Marlon Gwira, Francesco Nori, Martin A. Riedmiller, Nicolas Heess
2024ICLRReplay across Experiments: A Natural Extension of Off-Policy RL.Dhruva Tirumala, Thomas Lampe, Jos Enrique Chen, Tuomas Haarnoja, Sandy H. Huang, Guy Lever, Ben Moran, Tim Hertweck, Leonard Hasenclever, Martin A. Riedmiller, Nicolas Heess, Markus Wulfmeier
2024ICRAMastering Stacking of Diverse Shapes with Large-Scale Iterative Reinforcement Learning on Real Robots.Thomas Lampe, Abbas Abdolmaleki, Sarah Bechtle, Sandy H. Huang, Jost Tobias Springenberg, Michael Bloesch, Oliver Groth, Roland Hafner, Tim Hertweck, Michael Neunert, Markus Wulfmeier, Jingwei Zhang, Francesco Nori, Nicolas Heess, Martin A. Riedmiller
2021CoRLA Constrained Multi-Objective Reinforcement Learning Framework.Sandy H. Huang, Abbas Abdolmaleki, Giulia Vezzani, Philemon Brakel, Daniel J. Mankowitz, Michael Neunert, Steven Bohez, Yuval Tassa, Nicolas Heess, Martin A. Riedmiller, Raia Hadsell
2020ICMLA distributional view on multi-objective policy optimization.Abbas Abdolmaleki, Sandy H. Huang, Leonard Hasenclever, Michael Neunert, H. Francis Song, Martina Zambelli, Murilo F. Martins, Nicolas Heess, Raia Hadsell, Martin A. Riedmiller
2019AIESHuman-AI Learning Performance in Multi-Armed Bandits.Ravi Pandya, Sandy H. Huang, Dylan Hadfield-Menell, Anca D. Dragan
2019CoRLNonverbal Robot Feedback for Human Teachers.Sandy H. Huang, Isabella Huang, Ravi Pandya, Anca D. Dragan
2018HRIExpressing Robot Incapability.Minae Kwon, Sandy H. Huang, Anca D. Dragan
2018IROSEstablishing Appropriate Trust via Critical States.Sandy H. Huang, Kush Bhatia, Pieter Abbeel, Anca D. Dragan
2017ICLRAdversarial Attacks on Neural Network Policies.Sandy H. Huang, Nicolas Papernot, Ian J. Goodfellow, Yan Duan, Pieter Abbeel
2015ICRABeyond lowest-warping cost action selection in trajectory transfer.Dylan Hadfield-Menell, Alex X. Lee, Chelsea Finn, Eric Tzeng, Sandy H. Huang, Pieter Abbeel
2015IROSLeveraging appearance priors in non-rigid registration, with application to manipulation of deformable objects.Sandy H. Huang, Jia Pan, George Mulcaire, Pieter Abbeel
2014IROSUnifying scene registration and trajectory optimization for learning from demonstrations with application to manipulation of deformable objects.Alex X. Lee, Sandy H. Huang, Dylan Hadfield-Menell, Eric Tzeng, Pieter Abbeel