| 2026 | ACL | TemplateRL: Structured Template-Guided Reinforcement Learning for LLM Reasoning. | Jinyang Wu, Chonghua Liao, Mingkuan Feng, Shuai Zhang, Zhengqi Wen, Haoran Luo, Ling Yang, Huazhe Xu, Jianhua Tao |
| 2025 | CVPR | Two by Two: Learning Multi-Task Pairwise Objects Assembly for Generalizable Robot Manipulation. | Yu Qi, Yuanchen Ju, Tianming Wei, Chi Chu, Lawson L. S. Wong, Huazhe Xu |
| 2025 | ICCV | 4D Visual Pre-Training for Robot Learning. | Chengkai Hou, Yanjie Ze, Yankai Fu, Zeyu Gao, Songbo Hu, Yue Yu, Shanghang Zhang, Huazhe Xu |
| 2025 | ICLR | Looking Backward: Retrospective Backward Synthesis for Goal-Conditioned GFlowNets. | Haoran He, Can Chang, Huazhe Xu, Ling Pan |
| 2025 | ICLR | Stem-OB: Generalizable Visual Imitation Learning with Stem-Like Convergent Observation through Diffusion Inversion. | Kaizhe Hu, Zihang Rui, Yao He, Yuyao Liu, Pu Hua, Huazhe Xu |
| 2025 | ICLR | Robots Pre-train Robots: Manipulation-Centric Robotic Representation from Large-Scale Robot Datasets. | Guangqi Jiang, Yifei Sun, Tao Huang, Huanyu Li, Yongyuan Liang, Huazhe Xu |
| 2025 | ICLR | DenseMatcher: Learning 3D Semantic Correspondence for Category-Level Manipulation from a Single Demo. | Junzhe Zhu, Yuanchen Ju, Junyi Zhang, Muhan Wang, Zhecheng Yuan, Kaizhe Hu, Huazhe Xu |
| 2025 | ICML | MENTOR: Mixture-of-Experts Network with Task-Oriented Perturbation for Visual Reinforcement Learning. | Suning Huang, Zheyu Aqa Zhang, Tianhai Liang, Yihan Xu, Zhehao Kou, Chenhao Lu, Guowei Xu, Zhengrong Xue, Huazhe Xu |
| 2025 | ICML | A Forget-and-Grow Strategy for Deep Reinforcement Learning Scaling in Continuous Control. | Zilin Kang, Chenyuan Hu, Yu Luo, Zhecheng Yuan, Ruijie Zheng, Huazhe Xu |
| 2025 | ICRA | Fine-Tuning Hard-to-Simulate Objectives for Quadruped Locomotion: A Case Study on Total Power Saving. | Ruiqian Nai, Jiacheng You, Liu Cao, Hanchen Cui, Shiyuan Zhang, Huazhe Xu, Yang Gao |
| 2025 | IROS | DTactive: A Vision-Based Tactile Sensor with Active Surface. | Jikai Xu, Lei Wu, Changyi Lin, Ding Zhao, Huazhe Xu |
| 2025 | ICRA | Catch It! Learning to Catch in Flight with Mobile Dexterous Hands. | Yuanhang Zhang, Tianhai Liang, Zhenyang Chen, Yanjie Ze, Huazhe Xu |
| 2025 | NAACL | World Models with Hints of Large Language Models for Goal Achieving. | Zeyuan Liu, Ziyu Huan, Xiyao Wang, Jiafei Lyu, Jian Tao, Xiu Li, Furong Huang, Huazhe Xu |
| 2024 | CoRL | RiEMann: Near Real-Time SE(3)-Equivariant Robot Manipulation without Point Cloud Segmentation. | Chongkai Gao, Zhengrong Xue, Shuying Deng, Tianhai Liang, Siqi Yang, Lin Shao, Huazhe Xu |
| 2024 | CoRL | GenSim2: Scaling Robot Data Generation with Multi-modal and Reasoning LLMs. | Pu Hua, Minghuan Liu, Annabella Macaluso, Yunfeng Lin, Weinan Zhang, Huazhe Xu, Lirui Wang |
| 2024 | CoRL | Learning to Manipulate Anywhere: A Visual Generalizable Framework For Reinforcement Learning. | Zhecheng Yuan, Tianming Wei, Shuiqi Cheng, Gu Zhang, Yuanpei Chen, Huazhe Xu |
| 2024 | ECCV | Diffusion Reward: Learning Rewards via Conditional Video Diffusion. | Tao Huang, Guangqi Jiang, Yanjie Ze, Huazhe Xu |
| 2024 | ECCV | Robo-ABC: Affordance Generalization Beyond Categories via Semantic Correspondence for Robot Manipulation. | Yuanchen Ju, Kaizhe Hu, Guowei Zhang, Gu Zhang, Mingrun Jiang, Huazhe Xu |
| 2024 | ICLR | DittoGym: Learning to Control Soft Shape-Shifting Robots. | Suning Huang, Boyuan Chen, Huazhe Xu, Vincent Sitzmann |
| 2024 | ICLR | Uni-O4: Unifying Online and Offline Deep Reinforcement Learning with Multi-Step On-Policy Optimization. | Kun Lei, Zhengmao He, Chenhao Lu, Kaizhe Hu, Yang Gao, Huazhe Xu |
| 2024 | ICLR | Unleashing the Power of Pre-trained Language Models for Offline Reinforcement Learning. | Ruizhe Shi, Yuyao Liu, Yanjie Ze, Simon Shaolei Du, Huazhe Xu |
| 2024 | ICLR | GenSim: Generating Robotic Simulation Tasks via Large Language Models. | Lirui Wang, Yiyang Ling, Zhecheng Yuan, Mohit Shridhar, Chen Bao, Yuzhe Qin, Bailin Wang, Huazhe Xu, Xiaolong Wang |
| 2024 | ICLR | COPlanner: Plan to Roll Out Conservatively but to Explore Optimistically for Model-Based RL. | Xiyao Wang, Ruijie Zheng, Yanchao Sun, Ruonan Jia, Wichayaporn Wongkamjan, Huazhe Xu, Furong Huang |
| 2024 | ICLR | DrM: Mastering Visual Reinforcement Learning through Dormant Ratio Minimization. | Guowei Xu, Ruijie Zheng, Yongyuan Liang, Xiyao Wang, Zhecheng Yuan, Tianying Ji, Yu Luo, Xiaoyu Liu, Jiaxin Yuan, Pu Hua, Shuzhen Li, Yanjie Ze, Hal Daum III, Furong Huang, Huazhe Xu |
| 2024 | ICML | ACE: Off-Policy Actor-Critic with Causality-Aware Entropy Regularization. | Tianying Ji, Yongyuan Liang, Yan Zeng, Yu Luo, Guowei Xu, Jiawei Guo, Ruijie Zheng, Furong Huang, Fuchun Sun, Huazhe Xu |
| 2024 | ICML | Seizing Serendipity: Exploiting the Value of Past Success in Off-Policy Actor-Critic. | Tianying Ji, Yu Luo, Fuchun Sun, Xianyuan Zhan, Jianwei Zhang, Huazhe Xu |
| 2024 | ICML | OMPO: A Unified Framework for RL under Policy and Dynamics Shifts. | Yu Luo, Tianying Ji, Fuchun Sun, Jianwei Zhang, Huazhe Xu, Xianyuan Zhan |
| 2024 | ICML | Offline-Boosted Actor-Critic: Adaptively Blending Optimal Historical Behaviors in Deep Off-Policy RL. | Yu Luo, Tianying Ji, Fuchun Sun, Jianwei Zhang, Huazhe Xu, Xianyuan Zhan |
| 2024 | ICML | Rethinking Transformers in Solving POMDPs. | Chenhao Lu, Ruizhe Shi, Yuyao Liu, Kaizhe Hu, Simon Shaolei Du, Huazhe Xu |
| 2024 | ICML | Premier-TACO is a Few-Shot Policy Learner: Pretraining Multitask Representation via Temporal Action-Driven Contrastive Loss. | Ruijie Zheng, Yongyuan Liang, Xiyao Wang, Shuang Ma, Hal Daum III, Huazhe Xu, John Langford, Praveen Palanisamy, Kalyan Shankar Basu, Furong Huang |
| 2024 | ICRA | DeformNet: Latent Space Modeling and Dynamics Prediction for Deformable Object Manipulation. | Chenchang Li, Zihao Ai, Tong Wu, Xiaosa Li, Wenbo Ding, Huazhe Xu |
| 2024 | IROS | Learning Visual Quadrupedal Loco-Manipulation from Demonstrations. | Zhengmao He, Kun Lei, Yanjie Ze, Koushil Sreenath, Zhongyu Li, Huazhe Xu |
| 2024 | ICRA | A Wearable Robotic Hand for Hand-over-Hand Imitation Learning. | Dehao Wei, Huazhe Xu |
| 2024 | ICRA | ArrayBot: Reinforcement Learning for Generalizable Distributed Manipulation through Touch. | Zhengrong Xue, Han Zhang, Jingwen Cheng, Zhengmao He, Yuanchen Ju, Changyi Lin, Gu Zhang, Huazhe Xu |
| 2024 | WACV | OTAS: Unsupervised Boundary Detection for Object-Centric Temporal Action Segmentation. | Yuerong Li, Zhengrong Xue, Huazhe Xu |
| 2023 | CoRL | RoboCook: Long-Horizon Elasto-Plastic Object Manipulation with Diverse Tools. | Haochen Shi, Huazhe Xu, Samuel Clarke, Yunzhu Li, Jiajun Wu |
| 2023 | ICLR | Simple Emergent Action Representations from Multi-Task Policy Training. | Pu Hua, Yubei Chen, Huazhe Xu |
| 2023 | ICLR | Decision Transformer under Random Frame Dropping. | Kaizhe Hu, Ray Chen Zheng, Yang Gao, Huazhe Xu |
| 2023 | ICLR | Scaling up and Stabilizing Differentiable Planning with Implicit Differentiation. | Linfeng Zhao, Huazhe Xu, Lawson L. S. Wong |
| 2023 | ICLR | Is Model Ensemble Necessary? Model-based RL via a Single Model with Lipschitz Regularized Value Function. | Ruijie Zheng, Xiyao Wang, Huazhe Xu, Furong Huang |
| 2023 | ICML | On Pre-Training for Visuo-Motor Control: Revisiting a Learning-from-Scratch Baseline. | Nicklas Hansen, Zhecheng Yuan, Yanjie Ze, Tongzhou Mu, Aravind Rajeswaran, Hao Su, Huazhe Xu, Xiaolong Wang |
| 2023 | ICRA | DTact: A Vision-Based Tactile Sensor that Measures High-Resolution 3D Geometry Directly from Darkness. | Changyi Lin, Ziqi Lin, Shaoxiong Wang, Huazhe Xu |
| 2023 | ICRA | Efficient Bimanual Handover and Rearrangement via Symmetry-Aware Actor-Critic Learning. | Yunfei Li, Chaoyi Pan, Huazhe Xu, Xiaolong Wang, Yi Wu |
| 2023 | ICRA | USEEK: Unsupervised SE(3)-Equivariant 3D Keypoints for Generalizable Manipulation. | Zhengrong Xue, Zhecheng Yuan, Jiashun Wang, Xueqian Wang, Yang Gao, Huazhe Xu |
| 2023 | ICRA | Extraneousness-Aware Imitation Learning. | Ray Chen Zheng, Kaizhe Hu, Zhecheng Yuan, Boyuan Chen, Huazhe Xu |
| 2022 | CoRL | See, Hear, and Feel: Smart Sensory Fusion for Robotic Manipulation. | Hao Li, Yizhi Zhang, Junzhe Zhu, Shaoxiong Wang, Michelle A. Lee, Huazhe Xu, Edward H. Adelson, Li Fei-Fei, Ruohan Gao, Jiajun Wu |
| 2022 | ICLR | Learning Vision-Guided Quadrupedal Locomotion End-to-End with Cross-Modal Transformers. | Ruihan Yang, Minghao Zhang, Nicklas Hansen, Huazhe Xu, Xiaolong Wang |
| 2022 | ICML | Phasic Self-Imitative Reduction for Sparse-Reward Goal-Conditioned Reinforcement Learning. | Yunfei Li, Tian Gao, Jiaqi Yang, Huazhe Xu, Yi Wu |
| 2022 | ICML | Plan Better Amid Conservatism: Offline Multi-Agent Reinforcement Learning with Actor Rectification. | Ling Pan, Longbo Huang, Tengyu Ma, Huazhe Xu |
| 2022 | IJCAI | Don't Touch What Matters: Task-Aware Lipschitz Data Augmentation for Visual Reinforcement Learning. | Zhecheng Yuan, Guozheng Ma, Yao Mu, Bo Xia, Bo Yuan, Xueqian Wang, Ping Luo, Huazhe Xu |
| 2022 | IROS | Towards Learning to Play Piano with Dexterous Hands and Touch. | Huazhe Xu, Yuping Luo, Shaoxiong Wang, Trevor Darrell, Roberto Calandra |
| 2022 | SiggraphA | Scene Synthesis from Human Motion. | Sifan Ye, Yixing Wang, Jiaman Li, Dennis Park, C. Karen Liu, Huazhe Xu, Jiajun Wu |
| 2021 | CVPR | Synthesizing Long-Term 3D Human Motion and Interaction in 3D Scenes. | Jiashun Wang, Huazhe Xu, Jingwei Xu, Sifei Liu, Xiaolong Wang |
| 2021 | ICLR | Solving Compositional Reinforcement Learning Problems via Task Reduction. | Yunfei Li, Yilin Wu, Huazhe Xu, Xiaolong Wang, Yi Wu |
| 2021 | ICLR | Discovering Diverse Multi-Agent Strategic Behavior via Reward Randomization. | Zhenggang Tang, Chao Yu, Boyuan Chen, Huazhe Xu, Xiaolong Wang, Fei Fang, Simon Shaolei Du, Yu Wang, Yi Wu |
| 2021 | ICRA | PyTouch: A Machine Learning Library for Touch Processing. | Mike Lambeta, Huazhe Xu, Jingwei Xu, Po-Wei Chou, Shaoxiong Wang, Trevor Darrell, Roberto Calandra |
| 2021 | ICRA | Zero-shot Policy Learning with Spatial Temporal Reward Decomposition on Contingency-aware Observation. | Huazhe Xu, Boyuan Chen, Yang Gao, Trevor Darrell |
| 2020 | ECCV | Hierarchical Style-Based Networks for Motion Synthesis. | Jingwei Xu, Huazhe Xu, Bingbing Ni, Xiaokang Yang, Xiaolong Wang, Trevor Darrell |
| 2020 | ICLR | Learning Self-Correctable Policies and Value Functions from Demonstrations with Negative Sampling. | Yuping Luo, Huazhe Xu, Tengyu Ma |
| 2020 | ICML | Video Prediction via Example Guidance. | Jingwei Xu, Huazhe Xu, Bingbing Ni, Xiaokang Yang, Trevor Darrell |
| 2019 | ICCV | Disentangling Propagation and Generation for Video Prediction. | Hang Gao, Huazhe Xu, Qi-Zhi Cai, Ruth Wang, Fisher Yu, Trevor Darrell |
| 2019 | ICLR | Algorithmic Framework for Model-based Deep Reinforcement Learning with Theoretical Guarantees. | Yuping Luo, Huazhe Xu, Yuanzhi Li, Yuandong Tian, Trevor Darrell, Tengyu Ma |
| 2018 | ICLR | Reinforcement Learning from Imperfect Demonstrations. | Yang Gao, Huazhe Xu, Ji Lin, Fisher Yu, Sergey Levine, Trevor Darrell |
| 2017 | CVPR | End-to-End Learning of Driving Models from Large-Scale Video Datasets. | Huazhe Xu, Yang Gao, Fisher Yu, Trevor Darrell |
| 2016 | CVPR | Natural Language Object Retrieval. | Ronghang Hu, Huazhe Xu, Marcus Rohrbach, Jiashi Feng, Kate Saenko, Trevor Darrell |
| 2015 | VTC | A Low-Complexity Linear Precoding Scheme Based on SOR Method for Massive MIMO Systems. | Tian Xie, Qian Han, Huazhe Xu, Zihao Qi, Wenqian Shen |