| 2026 | AAAI | Faster Game Solving via Asymmetry of Step Sizes. | Linjian Meng, Tianpei Yang, Youzhi Zhang, Zhenxing Ge, Yang Gao |
| 2026 | AAAI | Tree-Based Stochastic Optimization for Solving Large-Scale Urban Network Security Games. | Shuxin Zhuang, Linjian Meng, Shuxin Li, Minming Li, Youzhi Zhang |
| 2026 | ACL | Thinking-Based Non-Thinking: Solving the Reward Hacking Problem in Training Hybrid Reasoning Models via Reinforcement Learning. | Siyuan Gan, Jiaheng Liu, Boyan Wang, Tianpei Yang, Runqing Miao, Yuyao Zhang, Fanyu Meng, Junlan Feng, Linjian Meng, Jing Huo, Yang Gao |
| 2025 | ICLR | Magnetic Preference Optimization: Achieving Last-iterate Convergence for Language Model Alignment. | Mingzhi Wang, Chengdong Ma, Qizhi Chen, Linjian Meng, Yang Han, Jiancong Xiao, Zhaowei Zhang, Jing Huo, Weijie J. Su, Yaodong Yang |
| 2025 | ICML | Reducing Variance of Stochastic Optimization for Approximating Nash Equilibria in Normal-Form Games. | Linjian Meng, Wubing Chen, Wenbin Li, Tianpei Yang, Youzhi Zhang, Yang Gao |
| 2024 | ICML | Safe and Robust Subgame Exploitation in Imperfect Information Games. | Zhenxing Ge, Zheng Xu, Tianyu Ding, Linjian Meng, Bo An, Wenbin Li, Yang Gao |
| 2023 | AAAI | An Efficient Deep Reinforcement Learning Algorithm for Solving Imperfect Information Extensive-Form Games. | Linjian Meng, Zhenxing Ge, Pinzhuo Tian, Bo An, Yang Gao |