| 2025 | ICML | CLARIFY: Contrastive Preference Reinforcement Learning for Untangling Ambiguous Queries. | Ni Mu, Hao Hu, Xiao Hu, Yiqin Yang, Bo Xu, Qing-Shan Jia |
| 2025 | IJCAI | S-EPOA: Overcoming the Indistinguishability of Segments with Skill-Driven Preference-Based Reinforcement Learning. | Ni Mu, Yao Luan, Yiqin Yang, Bo Xu, Qing-Shan Jia |
| 2024 | ICLR | Query-Policy Misalignment in Preference-Based Reinforcement Learning. | Xiao Hu, Jianxiong Li, Xianyuan Zhan, Qing-Shan Jia, Ya-Qin Zhang |
| 2024 | WSC | Simulation and AI for Critical Infrastructure. | Qing-Shan Jia, Chao Duan, Shuo Feng, Yuhang Zhu, Xiao Hu |
| 2023 | ICLR | Mind the Gap: Offline Policy Optimization for Imperfect Rewards. | Jianxiong Li, Xiao Hu, Haoran Xu, Jingjing Liu, Xianyuan Zhan, Qing-Shan Jia, Ya-Qin Zhang |
| 2020 | COMPSAC | Optimization of Large-Scale Commercial Electric Vehicles Fleet Charging Location Schedule Under the Distributed wind Power Supply. | Teng Long, Qing-Shan Jia |
| 2014 | DCOSS | Indoor Occupant Positioning System Using Active RFID Deployment and Particle Filters. | Kevin Weekly, Han Zou, Lihua Xie, Qing-Shan Jia, Alexandre M. Bayen |
| 2014 | ICRA | Sample path sharing in simulation-based policy improvement. | Di Wu, Qing-Shan Jia, Chun-Hung Chen |
| 2013 | IPIN | An integrative Weighted Path Loss and Extreme Learning Machine approach to Rfid based Indoor Positioning. | Han Zou, Lihua Xie, Qing-Shan Jia, Hengtao Wang |
| 2012 | ICARCV | Event-based sensor activation for indoor occupant distribution estimation. | Qing-Shan Jia, Zhe Wen, Li Xia |
| 2006 | ICRA | A SVM-based Method for Engine Maintenance Strategy Optimization. | Qing-Shan Jia, Qianchuan Zhao |