| 2025 | ICLR | Episodic Novelty Through Temporal Distance. | Yuhua Jiang, Qihan Liu, Yiqin Yang, Xiaoteng Ma, Dianyu Zhong, Hao Hu, Jun Yang, Bin Liang, Bo Xu, Chongjie Zhang, Qianchuan Zhao |
| 2025 | ICLR | Fewer May Be Better: Enhancing Offline Reinforcement Learning with Reduced Dataset. | Yiqin Yang, Quanwei Wang, Chenghao Li, Hao Hu, Chengjie Wu, Yuhua Jiang, Dianyu Zhong, Ziyou Zhang, Qianchuan Zhao, Chongjie Zhang, Bo Xu |
| 2024 | AAAI | Learning Diverse Risk Preferences in Population-Based Self-Play. | Yuhua Jiang, Qihan Liu, Xiaoteng Ma, Chenghao Li, Yiqin Yang, Jun Yang, Bin Liang, Qianchuan Zhao |
| 2024 | AAAI | No Prior Mask: Eliminate Redundant Action for Deep Reinforcement Learning. | Dianyu Zhong, Yiqin Yang, Qianchuan Zhao |
| 2024 | ICML | Bayesian Design Principles for Offline-to-Online Reinforcement Learning. | Hao Hu, Yiqin Yang, Jianing Ye, Chengjie Wu, Ziqing Mai, Yujing Hu, Tangjie Lv, Changjie Fan, Qianchuan Zhao, Chongjie Zhang |
| 2023 | AAAI | Flow to Control: Offline Reinforcement Learning with Lossless Primitive Discovery. | Yiqin Yang, Hao Hu, Wenzhe Li, Siyuan Li, Jun Yang, Qianchuan Zhao, Chongjie Zhang |
| 2023 | ICLR | The Provable Benefit of Unsupervised Data Sharing for Offline Reinforcement Learning. | Hao Hu, Yiqin Yang, Qianchuan Zhao, Chongjie Zhang |
| 2023 | IJCAI | Mean-Semivariance Policy Optimization via Risk-Averse Reinforcement Learning (Extended Abstract). | Xiaoteng Ma, Shuai Ma, Li Xia, Qianchuan Zhao |
| 2022 | ICLR | Offline Reinforcement Learning with Value-based Episodic Memory. | Xiaoteng Ma, Yiqin Yang, Hao Hu, Jun Yang, Chongjie Zhang, Qianchuan Zhao, Bin Liang, Qihan Liu |
| 2022 | ICML | On the Role of Discount Factor in Offline Reinforcement Learning. | Hao Hu, Yiqin Yang, Qianchuan Zhao, Chongjie Zhang |
| 2021 | IJCAI | Average-Reward Reinforcement Learning with Trust Region Methods. | Xiaoteng Ma, Xiaohang Tang, Li Xia, Jun Yang, Qianchuan Zhao |
| 2017 | IECON | The trade-off between security and performance of encrypted networked control systems. | Haijin Ding, Qianchuan Zhao, Rebing Wu |
| 2013 | ICRA | System identification for output-dependent bounded noises and its application in learning personalized thermal comfort model. | Yin Zhao, Qianchuan Zhao |
| 2010 | WCNC | Sensing and Communication Tradeoff for Cognitive Access of Continues-Time Markov Channels. | Xin Li, Qianchuan Zhao, Xiaohong Guan, Lang Tong |
| 2009 | MOBICOM | On the performance of cognitive access with periodic spectrum sensing. | Xin Li, Qianchuan Zhao, Xiaohong Guan, Lang Tong |
| 2007 | WCNC | Optimal Dynamic Spectrum Access via Periodic Channel Sensing. | Qianchuan Zhao, Stefan Geirhofer, Lang Tong, Brian M. Sadler |
| 2006 | ICRA | A SVM-based Method for Engine Maintenance Strategy Optimization. | Qing-Shan Jia, Qianchuan Zhao |
| 2006 | ICRA | Estimation of Optimal Elevator Scheduling Performance. | Jin Sun, Qianchuan Zhao, Peter B. Luh, Mikhail J. Atalla |
| 2004 | IROS | Joint replacement optimization for multi-part maintenance problems. | Tao Sun, Qianchuan Zhao, Peter B. Luh, Robert N. Tomastik |
| 2003 | IROS | Model reduction for fork/join overhaul & repair systems with rotable inventory. | Guoyu Tu, Qianchuan Zhao, Peter B. Luh, Jihua Wang |