Skip to content

Qianchuan Zhao

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

20

Venues

9

Active years

2003–2025

Best venue rank

A*

Where they publish

Papers

20 indexed papers, newest first.

YearVenueTitleAuthors
2025ICLREpisodic Novelty Through Temporal Distance.Yuhua Jiang, Qihan Liu, Yiqin Yang, Xiaoteng Ma, Dianyu Zhong, Hao Hu, Jun Yang, Bin Liang, Bo Xu, Chongjie Zhang, Qianchuan Zhao
2025ICLRFewer May Be Better: Enhancing Offline Reinforcement Learning with Reduced Dataset.Yiqin Yang, Quanwei Wang, Chenghao Li, Hao Hu, Chengjie Wu, Yuhua Jiang, Dianyu Zhong, Ziyou Zhang, Qianchuan Zhao, Chongjie Zhang, Bo Xu
2024AAAILearning Diverse Risk Preferences in Population-Based Self-Play.Yuhua Jiang, Qihan Liu, Xiaoteng Ma, Chenghao Li, Yiqin Yang, Jun Yang, Bin Liang, Qianchuan Zhao
2024AAAINo Prior Mask: Eliminate Redundant Action for Deep Reinforcement Learning.Dianyu Zhong, Yiqin Yang, Qianchuan Zhao
2024ICMLBayesian Design Principles for Offline-to-Online Reinforcement Learning.Hao Hu, Yiqin Yang, Jianing Ye, Chengjie Wu, Ziqing Mai, Yujing Hu, Tangjie Lv, Changjie Fan, Qianchuan Zhao, Chongjie Zhang
2023AAAIFlow to Control: Offline Reinforcement Learning with Lossless Primitive Discovery.Yiqin Yang, Hao Hu, Wenzhe Li, Siyuan Li, Jun Yang, Qianchuan Zhao, Chongjie Zhang
2023ICLRThe Provable Benefit of Unsupervised Data Sharing for Offline Reinforcement Learning.Hao Hu, Yiqin Yang, Qianchuan Zhao, Chongjie Zhang
2023IJCAIMean-Semivariance Policy Optimization via Risk-Averse Reinforcement Learning (Extended Abstract).Xiaoteng Ma, Shuai Ma, Li Xia, Qianchuan Zhao
2022ICLROffline Reinforcement Learning with Value-based Episodic Memory.Xiaoteng Ma, Yiqin Yang, Hao Hu, Jun Yang, Chongjie Zhang, Qianchuan Zhao, Bin Liang, Qihan Liu
2022ICMLOn the Role of Discount Factor in Offline Reinforcement Learning.Hao Hu, Yiqin Yang, Qianchuan Zhao, Chongjie Zhang
2021IJCAIAverage-Reward Reinforcement Learning with Trust Region Methods.Xiaoteng Ma, Xiaohang Tang, Li Xia, Jun Yang, Qianchuan Zhao
2017IECONThe trade-off between security and performance of encrypted networked control systems.Haijin Ding, Qianchuan Zhao, Rebing Wu
2013ICRASystem identification for output-dependent bounded noises and its application in learning personalized thermal comfort model.Yin Zhao, Qianchuan Zhao
2010WCNCSensing and Communication Tradeoff for Cognitive Access of Continues-Time Markov Channels.Xin Li, Qianchuan Zhao, Xiaohong Guan, Lang Tong
2009MOBICOMOn the performance of cognitive access with periodic spectrum sensing.Xin Li, Qianchuan Zhao, Xiaohong Guan, Lang Tong
2007WCNCOptimal Dynamic Spectrum Access via Periodic Channel Sensing.Qianchuan Zhao, Stefan Geirhofer, Lang Tong, Brian M. Sadler
2006ICRAA SVM-based Method for Engine Maintenance Strategy Optimization.Qing-Shan Jia, Qianchuan Zhao
2006ICRAEstimation of Optimal Elevator Scheduling Performance.Jin Sun, Qianchuan Zhao, Peter B. Luh, Mikhail J. Atalla
2004IROSJoint replacement optimization for multi-part maintenance problems.Tao Sun, Qianchuan Zhao, Peter B. Luh, Robert N. Tomastik
2003IROSModel reduction for fork/join overhaul & repair systems with rotable inventory.Guoyu Tu, Qianchuan Zhao, Peter B. Luh, Jihua Wang