| 2026 | ACL | AlphaQuanter: An End-to-End Tool-Augmented Agentic Reinforcement Learning Framework for Stock Trading. | Zheye Deng, Weixiang Yan, Changlong Yu, Jiashu Wang |
| 2025 | AAAI | CodeHalu: Investigating Code Hallucinations in LLMs via Execution-based Verification. | Yuchen Tian, Weixiang Yan, Qian Yang, Xuandong Zhao, Qian Chen, Wen Wang, Ziyang Luo, Lei Ma, Dawn Song |
| 2025 | COLING | CodeJudge-Eval: Can Large Language Models be Good Judges in Code Understanding? | Yuwei Zhao, Ziyang Luo, Yuchen Tian, Hongzhan Lin, Weixiang Yan, Annan Li, Jing Ma |
| 2024 | ACL | CodeScope: An Execution-based Multilingual Multitask Multidimensional Benchmark for Evaluating LLMs on Code Understanding and Generation. | Weixiang Yan, Haitian Liu, Yunkun Wang, Yunzhe Li, Qian Chen, Wen Wang, Tingyu Lin, Weishan Zhao, Li Zhu, Hari Sundaram, Shuiguang Deng |
| 2024 | EACL | Advancing Precise Outline-Conditioned Text Generation with Task Duality and Explicit Outline Control. | Yunzhe Li, Qian Chen, Weixiang Yan, Wen Wang, Qinglin Zhang, Hari Sundaram |
| 2024 | EMNLP | Decompose and Compare Consistency: Measuring VLMs' Answer Reliability via Task-Decomposition Consistency Comparison. | Qian Yang, Weixiang Yan, Aishwarya Agrawal |
| 2023 | EMNLP | CodeTransOcean: A Comprehensive Multilingual Benchmark for Code Translation. | Weixiang Yan, Yuchen Tian, Yunzhe Li, Qian Chen, Wen Wang |
| 2022 | ICSE | WhyGen: Explaining ML-powered Code Generation by Referring to Training Examples. | Weixiang Yan, Yuanchun Li |
| 2021 | ISSRE | Dependency-aware Form Understanding. | Shaokun Zhang, Yuanchun Li, Weixiang Yan, Yao Guo, Xiangqun Chen |