| 2026 | AAAI | WorldRFT: Latent World Model Planning with Reinforcement Fine-Tuning for Autonomous Driving. | Pengxuan Yang, Ben Lu, Zhongpu Xia, Chao Han, Yinfeng Gao, Teng Zhang, Kun Zhan, Xianpeng Lang, Yupeng Zheng, Qichao Zhang |
| 2026 | ACL | Spec-o3: A Tool-Augmented Vision-Language Agent for Rare Celestial Object Candidate Vetting via Automated Spectral Inspection. | Minghui Jia, Qichao Zhang, Ali Luo, Linjing Li, Shuo Ye, Hailing Lu, Wen Hou, Dongbin Zhao |
| 2026 | ACL | Beyond Query Memorization: Large Language Model Routing with Query Decomposition and Historical Matching. | Bo Lv, Jingbo Sun, Jianwei Lv, Chen Tang, Shaojie Zhang, Nayu Liu, Guoxin Yu, Zihao Li, Qichao Zhang, Dongbin Zhao, Ping Luo, Yue Yu |
| 2026 | ACL | AutoSearch: Adaptive Search Depth for Efficient Agentic RAG via Reinforcement Learning. | Jingbo Sun, Wenyue Chong, Songjun Tu, Qichao Zhang, Yaocheng Zhang, Jiajun Chai, Xiaohan Wang, Wei Lin, Guojun Yin, Dongbin Zhao |
| 2026 | ACL | CriticSearch: Fine-Grained Credit Assignment for Search Agents via a Retrospective Critic. | Yaocheng Zhang, Haohuan Huang, Zijun Song, Zijie Zhao, Qichao Zhang, Yuanheng Zhu, Dongbin Zhao |
| 2025 | AAAI | In-Dataset Trajectory Return Regularization for Offline Preference-based Reinforcement Learning. | Songjun Tu, Jingbo Sun, Qichao Zhang, Yaocheng Zhang, Jia Liu, Ke Chen, Dongbin Zhao |
| 2025 | EMNLP | RLAE: Reinforcement Learning-Assisted Ensemble for LLMs. | Yuqian Fu, Yuanheng Zhu, Jiajun Chai, Guojun Yin, Wei Lin, Qichao Zhang, Dongbin Zhao |
| 2025 | ICCV | World4Drive: End-to-End Autonomous Driving via Intention-Aware Physical Latent World Model. | Yupeng Zheng, Pengxuan Yang, Zebin Xing, Qichao Zhang, Yuhang Zheng, Yinfeng Gao, Pengfei Li, Teng Zhang, Zhongpu Xia, Peng Jia, Xianpeng Lang, Dongbin Zhao |
| 2025 | ICLR | Unsupervised Zero-Shot Reinforcement Learning via Dual-Value Forward-Backward Representation. | Jingbo Sun, Songjun Tu, Qichao Zhang, Haoran Li, Xin Liu, Yaran Chen, Ke Chen, Dongbin Zhao |
| 2025 | ICRA | UncAD: Towards Safe End-to-end Autonomous Driving via Online Map Uncertainty. | Pengxuan Yang, Yupeng Zheng, Qichao Zhang, Kefei Zhu, Zebin Xing, Qiao Lin, Yun-Fu Liu, Zhiguo Su, Dongbin Zhao |
| 2025 | SMC | FusionNav: Enhancing Zero-Shot Object-Goal Navigation via 3D Semantic Fusion and Farsight Value Reasoning. | Shugao Liu, Qichao Zhang, Haoran Li, Dongbin Zhao |
| 2024 | IJCNN | High-quality Synthetic Data is Efficient for Model-based Offline Reinforcement Learning. | Qichao Zhang, Xing Fang, Kaixuan Xu, Weixin Zhao, Haoran Li, Dongbin Zhao |
| 2024 | ICRA | MonoOcc: Digging into Monocular Semantic Occupancy Prediction. | Yupeng Zheng, Xiang Li, Pengfei Li, Yuhang Zheng, Bu Jin, Chengliang Zhong, Xiaoxiao Long, Hao Zhao, Qichao Zhang |
| 2024 | WWW | User Response Modeling in Reinforcement Learning for Ads Allocation. | Zhiyuan Zhang, Qichao Zhang, Xiaoxu Wu, Xiaowen Shi, Guogang Liao, Yongkang Wang, Xingxing Wang, Dongbin Zhao |
| 2023 | ICONIP | PnP: Integrated Prediction and Planning for Interactive Lane Change in Dense Traffic. | Xueyi Liu, Qichao Zhang, Yinfeng Gao, Zhongpu Xia |
| 2023 | ICRA | STEPS: Joint Self-supervised Nighttime Image Enhancement and Depth Estimation. | Yupeng Zheng, Chengliang Zhong, Pengfei Li, Huan-ang Gao, Yuhang Zheng, Bu Jin, Ling Wang, Hao Zhao, Guyue Zhou, Qichao Zhang, Dongbin Zhao |
| 2021 | IJCNN | Hierarchical Reinforcement Learning-Based Policy Switching Towards Multi-Scenarios Autonomous Driving. | Youtian Guo, Qichao Zhang, Junjie Wang, Shasha Liu |
| 2021 | IJCNN | IA-CNN: A generalised interpretable convolutional neural network with attention mechanism. | Zhisong Zhang, Yaran Chen, Haoran Li, Qichao Zhang |
| 2020 | IJCNN | RailNet: An Information Aggregation Network for Rail Track Segmentation. | Haoran Li, Qichao Zhang, Dongbin Zhao, Yaran Chen |
| 2019 | IJCNN | Lane Change Decision-making through Deep Reinforcement Learning with Rule-based Constraints. | Junjie Wang, Qichao Zhang, Dongbin Zhao, Yaran Chen |
| 2019 | IJCNN | Model-Free Reinforcement Learning based Lateral Control for Lane Keeping. | Qichao Zhang, Rui Luo, Dongbin Zhao, Chaomin Luo, Dianwei Qian |
| 2018 | ICONIP | Value Iteration Algorithm for Optimal Consensus Control of Multi-agent Systems. | Qichao Zhang, Dongbin Zhao |
| 2018 | ICPADS | Reputation-Based Byzantine Fault-Tolerance for Consortium Blockchain. | Kai Lei, Qichao Zhang, Limei Xu, Zhuyun Qi |
| 2018 | IJCNN | DeepSign: Deep Learning based Traffic Sign Recognition. | Dong Li, Dongbin Zhao, Yaran Chen, Qichao Zhang |
| 2018 | IJCNN | Visual Navigation with Actor-Critic Deep Reinforcement Learning. | Kun Shao, Dongbin Zhao, Yuanheng Zhu, Qichao Zhang |
| 2018 | IJCNN | Model-Free Reinforcement Learning for Fully Cooperative Multi-Agent Graphical Games. | Qichao Zhang, Dongbin Zhao, Frank L. Lewis |
| 2017 | ICONIP | Off-Policy Reinforcement Learning for Partially Unknown Nonzero-Sum Games. | Qichao Zhang, Dongbin Zhao, Sibo Zhang |
| 2017 | IJCNN | Policy gradient methods with Gaussian process modelling acceleration. | Dong Li, Dongbin Zhao, Qichao Zhang, Chaomin Luo |
| 2016 | IJCNN | Model-free reinforcement learning for nonlinear zero-sum games with simultaneous explorations. | Qichao Zhang, Dongbin Zhao, Yuanheng Zhu, Xi Chen |
| 2016 | IJCNN | Convolutional fitted Q iteration for vision-based control problems. | Dongbin Zhao, Yuanheng Zhu, Le Lv, Yaran Chen, Qichao Zhang |
| 2015 | ISNN | Event-Triggered H ∞ Control for Continuous-Time Nonlinear System. | Dongbin Zhao, Qichao Zhang, Xiangjun Li, Lingda Kong |