Skip to content

Xianyuan Zhan

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

31

Venues

11

Active years

2013–2025

Best venue rank

A*

Where they publish

Papers

31 indexed papers, newest first.

YearVenueTitleAuthors
2025AAAIAre Expressive Models Truly Necessary for Offline RL?Guan Wang, Haoyi Niu, Jianxiong Li, Li Jiang, Jianming Hu, Xianyuan Zhan
2025CVPRUniversal Actions for Enhanced Embodied Foundation Models.Jinliang Zheng, Jianxiong Li, Dongxiu Liu, Yinan Zheng, Zhihao Wang, Zhonghong Ou, Yu Liu, Jingjing Liu, Ya-Qin Zhang, Xianyuan Zhan
2025ICLRSkill Expansion and Composition in Parameter Space.Tenglong Liu, Jianxiong Li, Yinan Zheng, Haoyi Niu, Yixing Lan, Xin Xu, Xianyuan Zhan
2025ICLRData Center Cooling System Optimization Using Offline Reinforcement Learning.Xianyuan Zhan, Xiangyu Zhu, Peng Cheng, Xiao Hu, Ziteng He, Hanfei Geng, Jichao Leng, Huiwen Zheng, Chenhui Liu, Tianshun Hong, Yan Liang, Yunxin Liu, Feng Zhao
2025ICLRDiffusion-Based Planning for Autonomous Driving with Flexible Guidance.Yinan Zheng, Ruiming Liang, Kexin Zheng, Jinliang Zheng, Liyuan Mao, Jianxiong Li, Weihao Gu, Rui Ai, Shengbo Eben Li, Xianyuan Zhan, Jingjing Liu
2025ICMLEfficient Robotic Policy Learning via Latent Space Backward Planning.Dongxiu Liu, Haoyi Niu, Zhihao Wang, Jinliang Zheng, Yinan Zheng, Zhonghong Ou, Jianming Hu, Jianxiong Li, Xianyuan Zhan
2025ICRARobo-MUTUAL: Robotic Multimodal Task Specification via Unimodal Learning.Jianxiong Li, Zhihao Wang, Jinliang Zheng, Xiaoai Zhou, Guanming Wang, Guanglu Song, Yu Liu, Jingjing Liu, Ya-Qin Zhang, Junzhi Yu, Xianyuan Zhan
2025ICRAH2O+: An Improved Framework for Hybrid Offline-and-Online RL with Dynamics Gaps.Haoyi Niu, Tianying Ji, Bingqi Liu, Haocheng Zhao, Xiangyu Zhu, Jianying Zheng, Pengfei Huang, Guyue Zhou, Jianming Hu, Xianyuan Zhan
2024ECAIFlexSSL : A Generic and Efficient Framework for Semi-Supervised Learning.Huiling Qin, Xianyuan Zhan, Yuanxun Li, Yu Zheng
2024ICLRQuery-Policy Misalignment in Preference-Based Reinforcement Learning.Xiao Hu, Jianxiong Li, Xianyuan Zhan, Qing-Shan Jia, Ya-Qin Zhang
2024ICLRODICE: Revealing the Mystery of Distribution Correction Estimation via Orthogonal-gradient Update.Liyuan Mao, Haoran Xu, Weinan Zhang, Xianyuan Zhan
2024ICLROpenChat: Advancing Open-source Language Models with Mixed-Quality Data.Guan Wang, Sijie Cheng, Xianyuan Zhan, Xiangang Li, Sen Song, Yang Liu
2024ICLRSafe Offline Reinforcement Learning with Feasibility-Guided Diffusion Model.Yinan Zheng, Jianxiong Li, Dongjie Yu, Yujie Yang, Shengbo Eben Li, Xianyuan Zhan, Jingjing Liu
2024ICMLSeizing Serendipity: Exploiting the Value of Past Success in Off-Policy Actor-Critic.Tianying Ji, Yu Luo, Fuchun Sun, Xianyuan Zhan, Jianwei Zhang, Huazhe Xu
2024ICMLDecisionNCE: Embodied Multimodal Representations via Implicit Preference Learning.Jianxiong Li, Jinliang Zheng, Yinan Zheng, Liyuan Mao, Xiao Hu, Sijie Cheng, Haoyi Niu, Jihao Liu, Yu Liu, Jingjing Liu, Ya-Qin Zhang, Xianyuan Zhan
2024ICMLOMPO: A Unified Framework for RL under Policy and Dynamics Shifts.Yu Luo, Tianying Ji, Fuchun Sun, Jianwei Zhang, Huazhe Xu, Xianyuan Zhan
2024ICMLOffline-Boosted Actor-Critic: Adaptively Blending Optimal Historical Behaviors in Deep Off-Policy RL.Yu Luo, Tianying Ji, Fuchun Sun, Jianwei Zhang, Huazhe Xu, Xianyuan Zhan
2024ICPPTESLA: Thermally Safe, Load-Aware, and Energy-Efficient Cooling Control System for Data Centers.Hanfei Geng, Yi Sun, Yuanzhe Li, Jichao Leng, Xiangyu Zhu, Xianyuan Zhan, Yuanchun Li, Feng Zhao, Yunxin Liu
2024IJCAIA Comprehensive Survey of Cross-Domain Policy Transfer for Embodied Agents.Haoyi Niu, Jianming Hu, Guyue Zhou, Xianyuan Zhan
2023ICLRMind the Gap: Offline Policy Optimization for Imperfect Rewards.Jianxiong Li, Xiao Hu, Haoran Xu, Jingjing Liu, Xianyuan Zhan, Qing-Shan Jia, Ya-Qin Zhang
2023ICLRWhen Data Geometry Meets Deep Function: Generalizing Offline Reinforcement Learning.Jianxiong Li, Xianyuan Zhan, Haoran Xu, Xiangyu Zhu, Jingjing Liu, Ya-Qin Zhang
2023ICLROffline RL with No OOD Actions: In-Sample Learning via Implicit Value Regularization.Haoran Xu, Li Jiang, Jianxiong Li, Zhuoran Yang, Zhaoran Wang, Wai Kin Victor Chan, Xianyuan Zhan
2022AAAIConstraints Penalized Q-learning for Safe Offline Reinforcement Learning.Haoran Xu, Xianyuan Zhan, Xiangyu Zhu
2022AAAIDeepThermal: Combustion Optimization for Thermal Power Generating Units Using Offline Reinforcement Learning.Xianyuan Zhan, Haoran Xu, Yue Zhang, Xiangyu Zhu, Honglei Yin, Yu Zheng
2022CoRLDiscriminator-Guided Model-Based Offline Imitation Learning.Wenjia Zhang, Haoran Xu, Haoyi Niu, Peng Cheng, Ming Li, Heming Zhang, Guyue Zhou, Xianyuan Zhan
2022ECCVAdversarial Contrastive Learning via Asymmetric InfoNCE.Qiying Yu, Jieming Lou, Xianyuan Zhan, Qizhang Li, Wangmeng Zuo, Yang Liu, Jingjing Liu
2022ICMLDiscriminator-Weighted Offline Imitation Learning from Suboptimal Demonstrations.Haoran Xu, Xianyuan Zhan, Honglei Yin, Huiling Qin
2022IJCAIModel-Based Offline Planning with Trajectory Pruning.Xianyuan Zhan, Xiangyu Zhu, Haoran Xu
2021AAAIRobust Spatio-Temporal Purchase Prediction via Deep Meta Learning.Huiling Qin, Songyu Ke, Xiaodu Yang, Haoran Xu, Xianyuan Zhan, Yu Zheng
2021KDDNetwork-Wide Traffic States Imputation Using Self-interested Coalitional Learning.Huiling Qin, Xianyuan Zhan, Yuanxun Li, Xiaodu Yang, Yu Zheng
2013KDDUnderstanding urban human activity and mobility patterns using large-scale location-based data from online social media.Samiul Hasan, Xianyuan Zhan, Satish V. Ukkusuri