| 2025 | ACL | Learning Auxiliary Tasks Improves Reference-Free Hallucination Detection in Open-Domain Long-Form Generation. | Chengwei Qin, Wenxuan Zhou, Karthik Abinav Sankararaman, Nanshu Wang, Tengyu Xu, Alexander Radovic, Eryk Helenowski, Arya Talebzadeh, Aditya Tayade, Sinong Wang, Shafiq Joty, Han Fang, Hao Ma |
| 2025 | ICML | Think Smarter not Harder: Adaptive Reasoning with Inference Aware Optimization. | Zishun Yu, Tengyu Xu, Di Jin, Karthik Abinav Sankararaman, Yun He, Wenxuan Zhou, Zhouhao Zeng, Eryk Helenowski, Chen Zhu, Sinong Wang, Hao Ma, Han Fang |
| 2025 | KDD | HyperZero: A Customized End-to-End Auto-Tuning System for Recommendation with Hourly Feedback. | Xufeng Cai, Ziwei Guan, Lei Yuan, Ali Selman Aydin, Tengyu Xu, Boying Liu, Wenbo Ren, Renkai Xiang, Songyi He, Haichuan Yang, Serena Li, Mingze Gao, Yue Weng, Ji Liu |
| 2022 | ICLR | PER-ETD: A Polynomially Efficient Emphatic Temporal Difference Learning Method. | Ziwei Guan, Tengyu Xu, Yingbin Liang |
| 2022 | ICLR | Model-Based Offline Meta-Reinforcement Learning with Regularization. | Sen Lin, Jialin Wan, Tengyu Xu, Yingbin Liang, Junshan Zhang |
| 2022 | UAI | Deterministic policy gradient: Convergence analysis. | Huaqing Xiong, Tengyu Xu, Lin Zhao, Yingbin Liang, Wei Zhang |
| 2021 | AAAI | Non-asymptotic Convergence of Adam-type Reinforcement Learning Algorithms under Markovian Sampling. | Huaqing Xiong, Tengyu Xu, Yingbin Liang, Wei Zhang |
| 2021 | AISTATS | When Will Generative Adversarial Imitation Learning Algorithms Attain Global Convergence. | Ziwei Guan, Tengyu Xu, Yingbin Liang |
| 2021 | AISTATS | Sample Complexity Bounds for Two Timescale Value-based Reinforcement Learning Algorithms. | Tengyu Xu, Yingbin Liang |
| 2021 | ICLR | Proximal Gradient Descent-Ascent: Variable Convergence under KŁ Geometry. | Ziyi Chen, Yi Zhou, Tengyu Xu, Yingbin Liang |
| 2021 | ICML | CRPO: A New Approach for Safe Reinforcement Learning with Convergence Guarantee. | Tengyu Xu, Yingbin Liang, Guanghui Lan |
| 2021 | ICML | Doubly Robust Off-Policy Actor-Critic: Convergence and Optimality. | Tengyu Xu, Zhuoran Yang, Zhaoran Wang, Yingbin Liang |
| 2020 | ICLR | Reanalysis of Variance Reduced Temporal Difference Learning. | Tengyu Xu, Zhe Wang, Yi Zhou, Yingbin Liang |