Chenjun Xiao
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
21
Venues
7
Active years
2016–2026
Best venue rank
A*
Where they publish
Papers
21 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | An MRP Formulation for Supervised Learning: Generalized Temporal Difference Learning Models (Abstract Reprint). | Yangchen Pan, Junfeng Wen, Chenjun Xiao, Philip Torr |
| 2026 | ACL | Large Language Model-Enhanced Multi-Armed Bandits. | Jiahang Sun, Zhiyong Wang, Runhan Yang, Chenjun Xiao, John C. S. Lui, Zhongxiang Dai |
| 2025 | ICML | Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning. | Chen-Xiao Gao, Chenyang Wu, Mingjun Cao, Chenjun Xiao, Yang Yu, Zongzhang Zhang |
| 2024 | AAAI | Multiagent Gumbel MuZero: Efficient Planning in Combinatorial Action Spaces. | Xiaotian Hao, Jianye Hao, Chenjun Xiao, Kai Li, Dong Li, Yan Zheng |
| 2024 | ICML | Target Networks and Over-parameterization Stabilize Off-policy Bootstrapping with Function Approximation. | Fengdi Che, Chenjun Xiao, Jincheng Mei, Bo Dai, Ramki Gummadi, Oscar A. Ramirez, Christopher K. Harris, A. Rupam Mahmood, Dale Schuurmans |
| 2024 | ICML | HarmonyDream: Task Harmonization Inside World Models. | Haoyu Ma, Jialong Wu, Ningya Feng, Chenjun Xiao, Dong Li, Jianye Hao, Jianmin Wang, Mingsheng Long |
| 2024 | ICML | Rethinking Decision Transformer via Hierarchical Reinforcement Learning. | Yi Ma, Jianye Hao, Hebin Liang, Chenjun Xiao |
| 2024 | ICML | Provable Representation with Efficient Planning for Partially Observable Reinforcement Learning. | Hongming Zhang, Tongzheng Ren, Chenjun Xiao, Dale Schuurmans, Bo Dai |
| 2023 | ICLR | Latent Variable Representation for Reinforcement Learning. | Tongzheng Ren, Chenjun Xiao, Tianjun Zhang, Na Li, Zhaoran Wang, Sujay Sanghavi, Dale Schuurmans, Bo Dai |
| 2023 | ICLR | The In-Sample Softmax for Offline Reinforcement Learning. | Chenjun Xiao, Han Wang, Yangchen Pan, Adam White, Martha White |
| 2023 | ICLR | Replay Memory as An Empirical MDP: Combining Conservative Estimation with Experience Replay. | Hongming Zhang, Chenjun Xiao, Han Wang, Jun Jin, Bo Xu, Martin Mller |
| 2023 | UAI | Energy-based Predictive Representations for Partially Observed Reinforcement Learning. | Tianjun Zhang, Tongzheng Ren, Chenjun Xiao, Wenli Xiao, Joseph E. Gonzalez, Dale Schuurmans, Bo Dai |
| 2023 | UAI | Conditionally optimistic exploration for cooperative deep multi-agent reinforcement learning. | Xutong Zhao, Yangchen Pan, Chenjun Xiao, Sarath Chandar, Janarthanan Rajendran |
| 2022 | AISTATS | The Curse of Passive Data Collection in Batch Reinforcement Learning. | Chenjun Xiao, Ilbin Lee, Bo Dai, Dale Schuurmans, Csaba Szepesvri |
| 2022 | ICLR | Understanding and Leveraging Overparameterization in Recursive Value Estimation. | Chenjun Xiao, Bo Dai, Jincheng Mei, Oscar A. Ramirez, Ramki Gummadi, Chris Harris, Dale Schuurmans |
| 2021 | ICML | On the Optimality of Batch Policy Optimization Algorithms. | Chenjun Xiao, Yifan Wu, Jincheng Mei, Bo Dai, Tor Lattimore, Lihong Li, Csaba Szepesvri, Dale Schuurmans |
| 2020 | ICML | On the Global Convergence Rates of Softmax Policy Gradient Methods. | Jincheng Mei, Chenjun Xiao, Csaba Szepesvri, Dale Schuurmans |
| 2019 | IJCAI | On Principled Entropy Exploration in Policy Optimization. | Jincheng Mei, Chenjun Xiao, Ruitong Huang, Dale Schuurmans, Martin Mller |
| 2018 | AAAI | Memory-Augmented Monte Carlo Tree Search. | Chenjun Xiao, Jincheng Mei, Martin Mller |
| 2016 | AAAI | Factorization Ranking Model for Move Prediction in the Game of Go. | Chenjun Xiao, Martin Mller |
| 2016 | IJCAI | Integrating Factorization Ranked Features in MCTS: An Experimental Study. | Chenjun Xiao, Martin Mller |