| 2026 | AAAI | Towards Acyclic Preference Evaluation of Language Models via Multiple Evaluators. | Zhengyu Hu, Jieyu Zhang, Zhihan Xiong, Alexander Ratner, Kaize Ding, Ranjay Krishna |
| 2026 | COLT | On The Complexity of Best-Arm Identification in Non-Stationary Linear Bandits. | Leo Maynard-Zhang, Zhihan Xiong, Kevin Jamieson, Maryam Fazel |
| 2024 | AISTATS | A/B Testing and Best-arm Identification for Linear Bandits with Robustness to Non-stationarity. | Zhihan Xiong, Romain Camilleri, Maryam Fazel, Lalit Jain, Kevin Jamieson |
| 2024 | ICLR | A Black-box Approach for Non-stationary Multi-agent Reinforcement Learning. | Haozhe Jiang, Qiwen Cui, Zhihan Xiong, Maryam Fazel, Simon Shaolei Du |
| 2023 | ICLR | Offline Congestion Games: How Feedback Type Affects Data Coverage Requirement. | Haozhe Jiang, Qiwen Cui, Zhihan Xiong, Maryam Fazel, Simon Shaolei Du |
| 2022 | ICML | Fourier Learning with Cyclical Data. | Yingxiang Yang, Zhihan Xiong, Tianyi Liu, Taiqing Wang, Chong Wang |
| 2020 | AAAI | Parameterized Indexed Value Function for Efficient Exploration in Reinforcement Learning. | Tian Tan, Zhihan Xiong, Vikranth R. Dwaracherla |