Skip to content

Tengyu Xu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

13

Venues

7

Active years

2020–2025

Best venue rank

A*

Where they publish

Papers

13 indexed papers, newest first.

YearVenueTitleAuthors
2025ACLLearning Auxiliary Tasks Improves Reference-Free Hallucination Detection in Open-Domain Long-Form Generation.Chengwei Qin, Wenxuan Zhou, Karthik Abinav Sankararaman, Nanshu Wang, Tengyu Xu, Alexander Radovic, Eryk Helenowski, Arya Talebzadeh, Aditya Tayade, Sinong Wang, Shafiq Joty, Han Fang, Hao Ma
2025ICMLThink Smarter not Harder: Adaptive Reasoning with Inference Aware Optimization.Zishun Yu, Tengyu Xu, Di Jin, Karthik Abinav Sankararaman, Yun He, Wenxuan Zhou, Zhouhao Zeng, Eryk Helenowski, Chen Zhu, Sinong Wang, Hao Ma, Han Fang
2025KDDHyperZero: A Customized End-to-End Auto-Tuning System for Recommendation with Hourly Feedback.Xufeng Cai, Ziwei Guan, Lei Yuan, Ali Selman Aydin, Tengyu Xu, Boying Liu, Wenbo Ren, Renkai Xiang, Songyi He, Haichuan Yang, Serena Li, Mingze Gao, Yue Weng, Ji Liu
2022ICLRPER-ETD: A Polynomially Efficient Emphatic Temporal Difference Learning Method.Ziwei Guan, Tengyu Xu, Yingbin Liang
2022ICLRModel-Based Offline Meta-Reinforcement Learning with Regularization.Sen Lin, Jialin Wan, Tengyu Xu, Yingbin Liang, Junshan Zhang
2022UAIDeterministic policy gradient: Convergence analysis.Huaqing Xiong, Tengyu Xu, Lin Zhao, Yingbin Liang, Wei Zhang
2021AAAINon-asymptotic Convergence of Adam-type Reinforcement Learning Algorithms under Markovian Sampling.Huaqing Xiong, Tengyu Xu, Yingbin Liang, Wei Zhang
2021AISTATSWhen Will Generative Adversarial Imitation Learning Algorithms Attain Global Convergence.Ziwei Guan, Tengyu Xu, Yingbin Liang
2021AISTATSSample Complexity Bounds for Two Timescale Value-based Reinforcement Learning Algorithms.Tengyu Xu, Yingbin Liang
2021ICLRProximal Gradient Descent-Ascent: Variable Convergence under KŁ Geometry.Ziyi Chen, Yi Zhou, Tengyu Xu, Yingbin Liang
2021ICMLCRPO: A New Approach for Safe Reinforcement Learning with Convergence Guarantee.Tengyu Xu, Yingbin Liang, Guanghui Lan
2021ICMLDoubly Robust Off-Policy Actor-Critic: Convergence and Optimality.Tengyu Xu, Zhuoran Yang, Zhaoran Wang, Yingbin Liang
2020ICLRReanalysis of Variance Reduced Temporal Difference Learning.Tengyu Xu, Zhe Wang, Yi Zhou, Yingbin Liang