| 2026 | AAAI | GenPRM: Scaling Test-Time Compute of Process Reward Models via Generative Reasoning. | Jian Zhao, Runze Liu, Kaiyan Zhang, Zhimu Zhou, Junqi Gao, Dong Li, Jiafei Lyu, Zhouyi Qian, Biqing Qi, Xiu Li, Bowen Zhou |
| 2025 | AAAI | Novelty-Guided Data Reuse for Efficient and Diversified Multi-Agent Reinforcement Learning. | Yangkun Chen, Kai Yang, Jian Tao, Jiafei Lyu |
| 2025 | AAAI | SUMO: Search-Based Uncertainty Estimation for Model-Based Offline Reinforcement Learning. | Zhongjian Qiao, Jiafei Lyu, Kechen Jiao, Qi Liu, Xiu Li |
| 2025 | EMNLP | VLP: Vision-Language Preference Learning for Embodied Manipulation. | Runze Liu, Chenjia Bai, Jiafei Lyu, Shengjie Sun, Yali Du, Xiu Li |
| 2025 | ICLR | Cross-Domain Offline Policy Adaptation with Optimal Transport and Dataset Constraint. | Jiafei Lyu, Mengbei Yan, Zhongjian Qiao, Runze Liu, Xiaoteng Ma, Deheng Ye, Jingwen Yang, Zongqing Lu, Xiu Li |
| 2025 | NAACL | World Models with Hints of Large Language Models for Goal Achieving. | Zeyuan Liu, Ziyu Huan, Xiyao Wang, Jiafei Lyu, Jian Tao, Xiu Li, Furong Huang, Huazhe Xu |
| 2024 | CVPR | Using Human Feedback to Fine-tune Diffusion Models without Any Reward Model. | Kai Yang, Jian Tao, Jiafei Lyu, Chunjiang Ge, Jiaxin Chen, Weihan Shen, Xiaolong Zhu, Xiu Li |
| 2024 | ECAI | Mind the Model, Not the Agent: The Primacy Bias in Model-Based RL. | Zhongjian Qiao, Jiafei Lyu, Xiu Li |
| 2024 | ICANN | Enhancing Visual Generalization in Reinforcement Learning with Cycling Augmentation. | Shengjie Sun, Jiafei Lyu, Lu Li, Jiazhe Guo, Mengbei Yan, Runze Liu, Xiu Li |
| 2024 | ICLR | SEABO: A Simple Search-Based Method for Offline Imitation Learning. | Jiafei Lyu, Xiaoteng Ma, Le Wan, Runze Liu, Xiu Li, Zongqing Lu |
| 2024 | ICML | PEARL: Zero-shot Cross-task Preference Alignment and Robust Reward Learning for Robotic Manipulation. | Runze Liu, Yali Du, Fengshuo Bai, Jiafei Lyu, Xiu Li |
| 2024 | ICML | Cross-Domain Policy Adaptation by Capturing Representation Mismatch. | Jiafei Lyu, Chenjia Bai, Jingwen Yang, Zongqing Lu, Xiu Li |
| 2024 | ICML | Exploration and Anti-Exploration with Distributional Random Network Distillation. | Kai Yang, Jian Tao, Jiafei Lyu, Xiu Li |
| 2023 | ECAI | Uncertainty-Driven Trajectory Truncation for Data Augmentation in Offline Reinforcement Learning. | Junjie Zhang, Jiafei Lyu, Xiaoteng Ma, Jiangpeng Yan, Jun Yang, Le Wan, Xiu Li |
| 2023 | ICLR | State Advantage Weighting for Offline RL. | Jiafei Lyu, Aicheng Gong, Le Wan, Zongqing Lu, Xiu Li |
| 2022 | AAAI | Efficient Continuous Control with Double Actors and Regularized Critics. | Jiafei Lyu, Xiaoteng Ma, Jiangpeng Yan, Xiu Li |
| 2022 | PRICAI | PRAG: Periodic Regularized Action Gradient for Efficient Continuous Control. | Xihui Li, Zhongjian Qiao, Aicheng Gong, Jiafei Lyu, ChengHui Yu, Jiangpeng Yan, Xiu Li |