| 2025 | ICLR | Self-Play Preference Optimization for Language Model Alignment. | Yue Wu, Zhiqing Sun, Huizhuo Yuan, Kaixuan Ji, Yiming Yang, Quanquan Gu |
| 2025 | ICML | MARS: Unleashing the Power of Variance Reduction for Training Large Models. | Huizhuo Yuan, Yifeng Liu, Shuang Wu, Xun Zhou, Quanquan Gu |
| 2024 | ICML | Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models. | Zixiang Chen, Yihe Deng, Huizhuo Yuan, Kaixuan Ji, Quanquan Gu |
| 2024 | ICML | Protein Conformation Generation via Force-Guided SE(3) Diffusion Models. | Yan Wang, Lihao Wang, Yuning Shen, Yiqun Wang, Huizhuo Yuan, Yue Wu, Quanquan Gu |
| 2023 | ICLR | A General Framework for Sample-Efficient Function Approximation in Reinforcement Learning. | Zixiang Chen, Chris Junchi Li, Huizhuo Yuan, Quanquan Gu, Michael I. Jordan |
| 2023 | ICML | Nesterov Meets Optimism: Rate-Optimal Separable Minimax Optimization. | Chris Junchi Li, Huizhuo Yuan, Gauthier Gidel, Quanquan Gu, Michael I. Jordan |
| 2019 | ICML | Differential Inclusions for Modeling Nonsmooth ADMM Variants: A Continuous Limit Theory. | Huizhuo Yuan, Yuren Zhou, Chris Junchi Li, Qingyun Sun |