Skip to content

Chenjun Xiao

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

21

Venues

7

Active years

2016–2026

Best venue rank

A*

Where they publish

Papers

21 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIAn MRP Formulation for Supervised Learning: Generalized Temporal Difference Learning Models (Abstract Reprint).Yangchen Pan, Junfeng Wen, Chenjun Xiao, Philip Torr
2026ACLLarge Language Model-Enhanced Multi-Armed Bandits.Jiahang Sun, Zhiyong Wang, Runhan Yang, Chenjun Xiao, John C. S. Lui, Zhongxiang Dai
2025ICMLBehavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning.Chen-Xiao Gao, Chenyang Wu, Mingjun Cao, Chenjun Xiao, Yang Yu, Zongzhang Zhang
2024AAAIMultiagent Gumbel MuZero: Efficient Planning in Combinatorial Action Spaces.Xiaotian Hao, Jianye Hao, Chenjun Xiao, Kai Li, Dong Li, Yan Zheng
2024ICMLTarget Networks and Over-parameterization Stabilize Off-policy Bootstrapping with Function Approximation.Fengdi Che, Chenjun Xiao, Jincheng Mei, Bo Dai, Ramki Gummadi, Oscar A. Ramirez, Christopher K. Harris, A. Rupam Mahmood, Dale Schuurmans
2024ICMLHarmonyDream: Task Harmonization Inside World Models.Haoyu Ma, Jialong Wu, Ningya Feng, Chenjun Xiao, Dong Li, Jianye Hao, Jianmin Wang, Mingsheng Long
2024ICMLRethinking Decision Transformer via Hierarchical Reinforcement Learning.Yi Ma, Jianye Hao, Hebin Liang, Chenjun Xiao
2024ICMLProvable Representation with Efficient Planning for Partially Observable Reinforcement Learning.Hongming Zhang, Tongzheng Ren, Chenjun Xiao, Dale Schuurmans, Bo Dai
2023ICLRLatent Variable Representation for Reinforcement Learning.Tongzheng Ren, Chenjun Xiao, Tianjun Zhang, Na Li, Zhaoran Wang, Sujay Sanghavi, Dale Schuurmans, Bo Dai
2023ICLRThe In-Sample Softmax for Offline Reinforcement Learning.Chenjun Xiao, Han Wang, Yangchen Pan, Adam White, Martha White
2023ICLRReplay Memory as An Empirical MDP: Combining Conservative Estimation with Experience Replay.Hongming Zhang, Chenjun Xiao, Han Wang, Jun Jin, Bo Xu, Martin Mller
2023UAIEnergy-based Predictive Representations for Partially Observed Reinforcement Learning.Tianjun Zhang, Tongzheng Ren, Chenjun Xiao, Wenli Xiao, Joseph E. Gonzalez, Dale Schuurmans, Bo Dai
2023UAIConditionally optimistic exploration for cooperative deep multi-agent reinforcement learning.Xutong Zhao, Yangchen Pan, Chenjun Xiao, Sarath Chandar, Janarthanan Rajendran
2022AISTATSThe Curse of Passive Data Collection in Batch Reinforcement Learning.Chenjun Xiao, Ilbin Lee, Bo Dai, Dale Schuurmans, Csaba Szepesvri
2022ICLRUnderstanding and Leveraging Overparameterization in Recursive Value Estimation.Chenjun Xiao, Bo Dai, Jincheng Mei, Oscar A. Ramirez, Ramki Gummadi, Chris Harris, Dale Schuurmans
2021ICMLOn the Optimality of Batch Policy Optimization Algorithms.Chenjun Xiao, Yifan Wu, Jincheng Mei, Bo Dai, Tor Lattimore, Lihong Li, Csaba Szepesvri, Dale Schuurmans
2020ICMLOn the Global Convergence Rates of Softmax Policy Gradient Methods.Jincheng Mei, Chenjun Xiao, Csaba Szepesvri, Dale Schuurmans
2019IJCAIOn Principled Entropy Exploration in Policy Optimization.Jincheng Mei, Chenjun Xiao, Ruitong Huang, Dale Schuurmans, Martin Mller
2018AAAIMemory-Augmented Monte Carlo Tree Search.Chenjun Xiao, Jincheng Mei, Martin Mller
2016AAAIFactorization Ranking Model for Move Prediction in the Game of Go.Chenjun Xiao, Martin Mller
2016IJCAIIntegrating Factorization Ranked Features in MCTS: An Experimental Study.Chenjun Xiao, Martin Mller