| 2026 | AAAI | Diverse Human Driving Vehicle Simulation in Background Traffic for Autonomous Driving Tests. | Wendi Li, Hao Wu, Han Gao, Bing Mao, Fengyuan Xu, Sheng Zhong |
| 2026 | ACL | LAD: Learning Advantage Distribution for Reasoning. | Wendi Li, Sharon Li |
| 2026 | ACL | Uncertainty Quantification in LLM Agents: Foundations, Emerging Challenges, and Opportunities. | Changdae Oh, Seongheon Park, To Eun Kim, Jiatong Li, Wendi Li, Samuel Yeh, Sean Du, Hamed Hassani, Paul Bogdan, Dawn Song, Sharon Li |
| 2025 | ICLR | Process Reward Model with Q-value Rankings. | Wendi Li, Yixuan Li |
| 2025 | ICML | Free Process Rewards without Process Labels. | Lifan Yuan, Wendi Li, Huayu Chen, Ganqu Cui, Ning Ding, Kaiyan Zhang, Bowen Zhou, Zhiyuan Liu, Hao Peng |
| 2024 | IJCAI | Position Debiasing Fine-Tuning for Causal Perception in Long-Term Dialogue. | Shixuan Fan, Wei Wei, Wendi Li, Xian-Ling Mao, Wenfeng Xie, Dangyang Chen |
| 2024 | NAACL | Reinforcement Learning with Token-level Feedback for Controllable Text Generation. | Wendi Li, Wei Wei, Kaihe Xu, Wenfeng Xie, Dangyang Chen, Yu Cheng |
| 2023 | ACL | TREA: Tree-Structure Reasoning Schema for Conversational Recommendation. | Wendi Li, Wei Wei, Xiaoye Qu, Xian-Ling Mao, Ye Yuan, Wenfeng Xie, Dangyang Chen |
| 2023 | IJCAI | Towards Hierarchical Policy Learning for Conversational Recommendation with Hypergraph-based Reinforcement Learning. | Sen Zhao, Wei Wei, Yifan Liu, Ziyang Wang, Wendi Li, Xian-Ling Mao, Shuai Zhu, Minghui Yang, Zujie Wen |
| 2022 | AAAI | DDG-DA: Data Distribution Generation for Predictable Concept Drift Adaptation. | Wendi Li, Xiao Yang, Weiqing Liu, Yingce Xia, Jiang Bian |
| 2019 | ICMLC | Multi-Task Learning With Localized Generalization Error Model. | Wendi Li, Yi Zhu, Ting Wang, Wing W. Y. Ng |