Skip to content

Jiafei Lyu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

17

Venues

9

Active years

2022–2026

Best venue rank

A*

Where they publish

Papers

17 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIGenPRM: Scaling Test-Time Compute of Process Reward Models via Generative Reasoning.Jian Zhao, Runze Liu, Kaiyan Zhang, Zhimu Zhou, Junqi Gao, Dong Li, Jiafei Lyu, Zhouyi Qian, Biqing Qi, Xiu Li, Bowen Zhou
2025AAAINovelty-Guided Data Reuse for Efficient and Diversified Multi-Agent Reinforcement Learning.Yangkun Chen, Kai Yang, Jian Tao, Jiafei Lyu
2025AAAISUMO: Search-Based Uncertainty Estimation for Model-Based Offline Reinforcement Learning.Zhongjian Qiao, Jiafei Lyu, Kechen Jiao, Qi Liu, Xiu Li
2025EMNLPVLP: Vision-Language Preference Learning for Embodied Manipulation.Runze Liu, Chenjia Bai, Jiafei Lyu, Shengjie Sun, Yali Du, Xiu Li
2025ICLRCross-Domain Offline Policy Adaptation with Optimal Transport and Dataset Constraint.Jiafei Lyu, Mengbei Yan, Zhongjian Qiao, Runze Liu, Xiaoteng Ma, Deheng Ye, Jingwen Yang, Zongqing Lu, Xiu Li
2025NAACLWorld Models with Hints of Large Language Models for Goal Achieving.Zeyuan Liu, Ziyu Huan, Xiyao Wang, Jiafei Lyu, Jian Tao, Xiu Li, Furong Huang, Huazhe Xu
2024CVPRUsing Human Feedback to Fine-tune Diffusion Models without Any Reward Model.Kai Yang, Jian Tao, Jiafei Lyu, Chunjiang Ge, Jiaxin Chen, Weihan Shen, Xiaolong Zhu, Xiu Li
2024ECAIMind the Model, Not the Agent: The Primacy Bias in Model-Based RL.Zhongjian Qiao, Jiafei Lyu, Xiu Li
2024ICANNEnhancing Visual Generalization in Reinforcement Learning with Cycling Augmentation.Shengjie Sun, Jiafei Lyu, Lu Li, Jiazhe Guo, Mengbei Yan, Runze Liu, Xiu Li
2024ICLRSEABO: A Simple Search-Based Method for Offline Imitation Learning.Jiafei Lyu, Xiaoteng Ma, Le Wan, Runze Liu, Xiu Li, Zongqing Lu
2024ICMLPEARL: Zero-shot Cross-task Preference Alignment and Robust Reward Learning for Robotic Manipulation.Runze Liu, Yali Du, Fengshuo Bai, Jiafei Lyu, Xiu Li
2024ICMLCross-Domain Policy Adaptation by Capturing Representation Mismatch.Jiafei Lyu, Chenjia Bai, Jingwen Yang, Zongqing Lu, Xiu Li
2024ICMLExploration and Anti-Exploration with Distributional Random Network Distillation.Kai Yang, Jian Tao, Jiafei Lyu, Xiu Li
2023ECAIUncertainty-Driven Trajectory Truncation for Data Augmentation in Offline Reinforcement Learning.Junjie Zhang, Jiafei Lyu, Xiaoteng Ma, Jiangpeng Yan, Jun Yang, Le Wan, Xiu Li
2023ICLRState Advantage Weighting for Offline RL.Jiafei Lyu, Aicheng Gong, Le Wan, Zongqing Lu, Xiu Li
2022AAAIEfficient Continuous Control with Double Actors and Regularized Critics.Jiafei Lyu, Xiaoteng Ma, Jiangpeng Yan, Xiu Li
2022PRICAIPRAG: Periodic Regularized Action Gradient for Efficient Continuous Control.Xihui Li, Zhongjian Qiao, Aicheng Gong, Jiafei Lyu, ChengHui Yu, Jiangpeng Yan, Xiu Li