Skip to content

Huazhe Xu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

66

Venues

14

Active years

2015–2026

Best venue rank

A*

Where they publish

Papers

66 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLTemplateRL: Structured Template-Guided Reinforcement Learning for LLM Reasoning.Jinyang Wu, Chonghua Liao, Mingkuan Feng, Shuai Zhang, Zhengqi Wen, Haoran Luo, Ling Yang, Huazhe Xu, Jianhua Tao
2025CVPRTwo by Two: Learning Multi-Task Pairwise Objects Assembly for Generalizable Robot Manipulation.Yu Qi, Yuanchen Ju, Tianming Wei, Chi Chu, Lawson L. S. Wong, Huazhe Xu
2025ICCV4D Visual Pre-Training for Robot Learning.Chengkai Hou, Yanjie Ze, Yankai Fu, Zeyu Gao, Songbo Hu, Yue Yu, Shanghang Zhang, Huazhe Xu
2025ICLRLooking Backward: Retrospective Backward Synthesis for Goal-Conditioned GFlowNets.Haoran He, Can Chang, Huazhe Xu, Ling Pan
2025ICLRStem-OB: Generalizable Visual Imitation Learning with Stem-Like Convergent Observation through Diffusion Inversion.Kaizhe Hu, Zihang Rui, Yao He, Yuyao Liu, Pu Hua, Huazhe Xu
2025ICLRRobots Pre-train Robots: Manipulation-Centric Robotic Representation from Large-Scale Robot Datasets.Guangqi Jiang, Yifei Sun, Tao Huang, Huanyu Li, Yongyuan Liang, Huazhe Xu
2025ICLRDenseMatcher: Learning 3D Semantic Correspondence for Category-Level Manipulation from a Single Demo.Junzhe Zhu, Yuanchen Ju, Junyi Zhang, Muhan Wang, Zhecheng Yuan, Kaizhe Hu, Huazhe Xu
2025ICMLMENTOR: Mixture-of-Experts Network with Task-Oriented Perturbation for Visual Reinforcement Learning.Suning Huang, Zheyu Aqa Zhang, Tianhai Liang, Yihan Xu, Zhehao Kou, Chenhao Lu, Guowei Xu, Zhengrong Xue, Huazhe Xu
2025ICMLA Forget-and-Grow Strategy for Deep Reinforcement Learning Scaling in Continuous Control.Zilin Kang, Chenyuan Hu, Yu Luo, Zhecheng Yuan, Ruijie Zheng, Huazhe Xu
2025ICRAFine-Tuning Hard-to-Simulate Objectives for Quadruped Locomotion: A Case Study on Total Power Saving.Ruiqian Nai, Jiacheng You, Liu Cao, Hanchen Cui, Shiyuan Zhang, Huazhe Xu, Yang Gao
2025IROSDTactive: A Vision-Based Tactile Sensor with Active Surface.Jikai Xu, Lei Wu, Changyi Lin, Ding Zhao, Huazhe Xu
2025ICRACatch It! Learning to Catch in Flight with Mobile Dexterous Hands.Yuanhang Zhang, Tianhai Liang, Zhenyang Chen, Yanjie Ze, Huazhe Xu
2025NAACLWorld Models with Hints of Large Language Models for Goal Achieving.Zeyuan Liu, Ziyu Huan, Xiyao Wang, Jiafei Lyu, Jian Tao, Xiu Li, Furong Huang, Huazhe Xu
2024CoRLRiEMann: Near Real-Time SE(3)-Equivariant Robot Manipulation without Point Cloud Segmentation.Chongkai Gao, Zhengrong Xue, Shuying Deng, Tianhai Liang, Siqi Yang, Lin Shao, Huazhe Xu
2024CoRLGenSim2: Scaling Robot Data Generation with Multi-modal and Reasoning LLMs.Pu Hua, Minghuan Liu, Annabella Macaluso, Yunfeng Lin, Weinan Zhang, Huazhe Xu, Lirui Wang
2024CoRLLearning to Manipulate Anywhere: A Visual Generalizable Framework For Reinforcement Learning.Zhecheng Yuan, Tianming Wei, Shuiqi Cheng, Gu Zhang, Yuanpei Chen, Huazhe Xu
2024ECCVDiffusion Reward: Learning Rewards via Conditional Video Diffusion.Tao Huang, Guangqi Jiang, Yanjie Ze, Huazhe Xu
2024ECCVRobo-ABC: Affordance Generalization Beyond Categories via Semantic Correspondence for Robot Manipulation.Yuanchen Ju, Kaizhe Hu, Guowei Zhang, Gu Zhang, Mingrun Jiang, Huazhe Xu
2024ICLRDittoGym: Learning to Control Soft Shape-Shifting Robots.Suning Huang, Boyuan Chen, Huazhe Xu, Vincent Sitzmann
2024ICLRUni-O4: Unifying Online and Offline Deep Reinforcement Learning with Multi-Step On-Policy Optimization.Kun Lei, Zhengmao He, Chenhao Lu, Kaizhe Hu, Yang Gao, Huazhe Xu
2024ICLRUnleashing the Power of Pre-trained Language Models for Offline Reinforcement Learning.Ruizhe Shi, Yuyao Liu, Yanjie Ze, Simon Shaolei Du, Huazhe Xu
2024ICLRGenSim: Generating Robotic Simulation Tasks via Large Language Models.Lirui Wang, Yiyang Ling, Zhecheng Yuan, Mohit Shridhar, Chen Bao, Yuzhe Qin, Bailin Wang, Huazhe Xu, Xiaolong Wang
2024ICLRCOPlanner: Plan to Roll Out Conservatively but to Explore Optimistically for Model-Based RL.Xiyao Wang, Ruijie Zheng, Yanchao Sun, Ruonan Jia, Wichayaporn Wongkamjan, Huazhe Xu, Furong Huang
2024ICLRDrM: Mastering Visual Reinforcement Learning through Dormant Ratio Minimization.Guowei Xu, Ruijie Zheng, Yongyuan Liang, Xiyao Wang, Zhecheng Yuan, Tianying Ji, Yu Luo, Xiaoyu Liu, Jiaxin Yuan, Pu Hua, Shuzhen Li, Yanjie Ze, Hal Daum III, Furong Huang, Huazhe Xu
2024ICMLACE: Off-Policy Actor-Critic with Causality-Aware Entropy Regularization.Tianying Ji, Yongyuan Liang, Yan Zeng, Yu Luo, Guowei Xu, Jiawei Guo, Ruijie Zheng, Furong Huang, Fuchun Sun, Huazhe Xu
2024ICMLSeizing Serendipity: Exploiting the Value of Past Success in Off-Policy Actor-Critic.Tianying Ji, Yu Luo, Fuchun Sun, Xianyuan Zhan, Jianwei Zhang, Huazhe Xu
2024ICMLOMPO: A Unified Framework for RL under Policy and Dynamics Shifts.Yu Luo, Tianying Ji, Fuchun Sun, Jianwei Zhang, Huazhe Xu, Xianyuan Zhan
2024ICMLOffline-Boosted Actor-Critic: Adaptively Blending Optimal Historical Behaviors in Deep Off-Policy RL.Yu Luo, Tianying Ji, Fuchun Sun, Jianwei Zhang, Huazhe Xu, Xianyuan Zhan
2024ICMLRethinking Transformers in Solving POMDPs.Chenhao Lu, Ruizhe Shi, Yuyao Liu, Kaizhe Hu, Simon Shaolei Du, Huazhe Xu
2024ICMLPremier-TACO is a Few-Shot Policy Learner: Pretraining Multitask Representation via Temporal Action-Driven Contrastive Loss.Ruijie Zheng, Yongyuan Liang, Xiyao Wang, Shuang Ma, Hal Daum III, Huazhe Xu, John Langford, Praveen Palanisamy, Kalyan Shankar Basu, Furong Huang
2024ICRADeformNet: Latent Space Modeling and Dynamics Prediction for Deformable Object Manipulation.Chenchang Li, Zihao Ai, Tong Wu, Xiaosa Li, Wenbo Ding, Huazhe Xu
2024IROSLearning Visual Quadrupedal Loco-Manipulation from Demonstrations.Zhengmao He, Kun Lei, Yanjie Ze, Koushil Sreenath, Zhongyu Li, Huazhe Xu
2024ICRAA Wearable Robotic Hand for Hand-over-Hand Imitation Learning.Dehao Wei, Huazhe Xu
2024ICRAArrayBot: Reinforcement Learning for Generalizable Distributed Manipulation through Touch.Zhengrong Xue, Han Zhang, Jingwen Cheng, Zhengmao He, Yuanchen Ju, Changyi Lin, Gu Zhang, Huazhe Xu
2024WACVOTAS: Unsupervised Boundary Detection for Object-Centric Temporal Action Segmentation.Yuerong Li, Zhengrong Xue, Huazhe Xu
2023CoRLRoboCook: Long-Horizon Elasto-Plastic Object Manipulation with Diverse Tools.Haochen Shi, Huazhe Xu, Samuel Clarke, Yunzhu Li, Jiajun Wu
2023ICLRSimple Emergent Action Representations from Multi-Task Policy Training.Pu Hua, Yubei Chen, Huazhe Xu
2023ICLRDecision Transformer under Random Frame Dropping.Kaizhe Hu, Ray Chen Zheng, Yang Gao, Huazhe Xu
2023ICLRScaling up and Stabilizing Differentiable Planning with Implicit Differentiation.Linfeng Zhao, Huazhe Xu, Lawson L. S. Wong
2023ICLRIs Model Ensemble Necessary? Model-based RL via a Single Model with Lipschitz Regularized Value Function.Ruijie Zheng, Xiyao Wang, Huazhe Xu, Furong Huang
2023ICMLOn Pre-Training for Visuo-Motor Control: Revisiting a Learning-from-Scratch Baseline.Nicklas Hansen, Zhecheng Yuan, Yanjie Ze, Tongzhou Mu, Aravind Rajeswaran, Hao Su, Huazhe Xu, Xiaolong Wang
2023ICRADTact: A Vision-Based Tactile Sensor that Measures High-Resolution 3D Geometry Directly from Darkness.Changyi Lin, Ziqi Lin, Shaoxiong Wang, Huazhe Xu
2023ICRAEfficient Bimanual Handover and Rearrangement via Symmetry-Aware Actor-Critic Learning.Yunfei Li, Chaoyi Pan, Huazhe Xu, Xiaolong Wang, Yi Wu
2023ICRAUSEEK: Unsupervised SE(3)-Equivariant 3D Keypoints for Generalizable Manipulation.Zhengrong Xue, Zhecheng Yuan, Jiashun Wang, Xueqian Wang, Yang Gao, Huazhe Xu
2023ICRAExtraneousness-Aware Imitation Learning.Ray Chen Zheng, Kaizhe Hu, Zhecheng Yuan, Boyuan Chen, Huazhe Xu
2022CoRLSee, Hear, and Feel: Smart Sensory Fusion for Robotic Manipulation.Hao Li, Yizhi Zhang, Junzhe Zhu, Shaoxiong Wang, Michelle A. Lee, Huazhe Xu, Edward H. Adelson, Li Fei-Fei, Ruohan Gao, Jiajun Wu
2022ICLRLearning Vision-Guided Quadrupedal Locomotion End-to-End with Cross-Modal Transformers.Ruihan Yang, Minghao Zhang, Nicklas Hansen, Huazhe Xu, Xiaolong Wang
2022ICMLPhasic Self-Imitative Reduction for Sparse-Reward Goal-Conditioned Reinforcement Learning.Yunfei Li, Tian Gao, Jiaqi Yang, Huazhe Xu, Yi Wu
2022ICMLPlan Better Amid Conservatism: Offline Multi-Agent Reinforcement Learning with Actor Rectification.Ling Pan, Longbo Huang, Tengyu Ma, Huazhe Xu
2022IJCAIDon't Touch What Matters: Task-Aware Lipschitz Data Augmentation for Visual Reinforcement Learning.Zhecheng Yuan, Guozheng Ma, Yao Mu, Bo Xia, Bo Yuan, Xueqian Wang, Ping Luo, Huazhe Xu
2022IROSTowards Learning to Play Piano with Dexterous Hands and Touch.Huazhe Xu, Yuping Luo, Shaoxiong Wang, Trevor Darrell, Roberto Calandra
2022SiggraphAScene Synthesis from Human Motion.Sifan Ye, Yixing Wang, Jiaman Li, Dennis Park, C. Karen Liu, Huazhe Xu, Jiajun Wu
2021CVPRSynthesizing Long-Term 3D Human Motion and Interaction in 3D Scenes.Jiashun Wang, Huazhe Xu, Jingwei Xu, Sifei Liu, Xiaolong Wang
2021ICLRSolving Compositional Reinforcement Learning Problems via Task Reduction.Yunfei Li, Yilin Wu, Huazhe Xu, Xiaolong Wang, Yi Wu
2021ICLRDiscovering Diverse Multi-Agent Strategic Behavior via Reward Randomization.Zhenggang Tang, Chao Yu, Boyuan Chen, Huazhe Xu, Xiaolong Wang, Fei Fang, Simon Shaolei Du, Yu Wang, Yi Wu
2021ICRAPyTouch: A Machine Learning Library for Touch Processing.Mike Lambeta, Huazhe Xu, Jingwei Xu, Po-Wei Chou, Shaoxiong Wang, Trevor Darrell, Roberto Calandra
2021ICRAZero-shot Policy Learning with Spatial Temporal Reward Decomposition on Contingency-aware Observation.Huazhe Xu, Boyuan Chen, Yang Gao, Trevor Darrell
2020ECCVHierarchical Style-Based Networks for Motion Synthesis.Jingwei Xu, Huazhe Xu, Bingbing Ni, Xiaokang Yang, Xiaolong Wang, Trevor Darrell
2020ICLRLearning Self-Correctable Policies and Value Functions from Demonstrations with Negative Sampling.Yuping Luo, Huazhe Xu, Tengyu Ma
2020ICMLVideo Prediction via Example Guidance.Jingwei Xu, Huazhe Xu, Bingbing Ni, Xiaokang Yang, Trevor Darrell
2019ICCVDisentangling Propagation and Generation for Video Prediction.Hang Gao, Huazhe Xu, Qi-Zhi Cai, Ruth Wang, Fisher Yu, Trevor Darrell
2019ICLRAlgorithmic Framework for Model-based Deep Reinforcement Learning with Theoretical Guarantees.Yuping Luo, Huazhe Xu, Yuanzhi Li, Yuandong Tian, Trevor Darrell, Tengyu Ma
2018ICLRReinforcement Learning from Imperfect Demonstrations.Yang Gao, Huazhe Xu, Ji Lin, Fisher Yu, Sergey Levine, Trevor Darrell
2017CVPREnd-to-End Learning of Driving Models from Large-Scale Video Datasets.Huazhe Xu, Yang Gao, Fisher Yu, Trevor Darrell
2016CVPRNatural Language Object Retrieval.Ronghang Hu, Huazhe Xu, Marcus Rohrbach, Jiashi Feng, Kate Saenko, Trevor Darrell
2015VTCA Low-Complexity Linear Precoding Scheme Based on SOR Method for Massive MIMO Systems.Tian Xie, Qian Han, Huazhe Xu, Zihao Qi, Wenqian Shen