Skip to content

Qichao Zhang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

31

Venues

12

Active years

2015–2026

Best venue rank

A*

Where they publish

Papers

31 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIWorldRFT: Latent World Model Planning with Reinforcement Fine-Tuning for Autonomous Driving.Pengxuan Yang, Ben Lu, Zhongpu Xia, Chao Han, Yinfeng Gao, Teng Zhang, Kun Zhan, Xianpeng Lang, Yupeng Zheng, Qichao Zhang
2026ACLSpec-o3: A Tool-Augmented Vision-Language Agent for Rare Celestial Object Candidate Vetting via Automated Spectral Inspection.Minghui Jia, Qichao Zhang, Ali Luo, Linjing Li, Shuo Ye, Hailing Lu, Wen Hou, Dongbin Zhao
2026ACLBeyond Query Memorization: Large Language Model Routing with Query Decomposition and Historical Matching.Bo Lv, Jingbo Sun, Jianwei Lv, Chen Tang, Shaojie Zhang, Nayu Liu, Guoxin Yu, Zihao Li, Qichao Zhang, Dongbin Zhao, Ping Luo, Yue Yu
2026ACLAutoSearch: Adaptive Search Depth for Efficient Agentic RAG via Reinforcement Learning.Jingbo Sun, Wenyue Chong, Songjun Tu, Qichao Zhang, Yaocheng Zhang, Jiajun Chai, Xiaohan Wang, Wei Lin, Guojun Yin, Dongbin Zhao
2026ACLCriticSearch: Fine-Grained Credit Assignment for Search Agents via a Retrospective Critic.Yaocheng Zhang, Haohuan Huang, Zijun Song, Zijie Zhao, Qichao Zhang, Yuanheng Zhu, Dongbin Zhao
2025AAAIIn-Dataset Trajectory Return Regularization for Offline Preference-based Reinforcement Learning.Songjun Tu, Jingbo Sun, Qichao Zhang, Yaocheng Zhang, Jia Liu, Ke Chen, Dongbin Zhao
2025EMNLPRLAE: Reinforcement Learning-Assisted Ensemble for LLMs.Yuqian Fu, Yuanheng Zhu, Jiajun Chai, Guojun Yin, Wei Lin, Qichao Zhang, Dongbin Zhao
2025ICCVWorld4Drive: End-to-End Autonomous Driving via Intention-Aware Physical Latent World Model.Yupeng Zheng, Pengxuan Yang, Zebin Xing, Qichao Zhang, Yuhang Zheng, Yinfeng Gao, Pengfei Li, Teng Zhang, Zhongpu Xia, Peng Jia, Xianpeng Lang, Dongbin Zhao
2025ICLRUnsupervised Zero-Shot Reinforcement Learning via Dual-Value Forward-Backward Representation.Jingbo Sun, Songjun Tu, Qichao Zhang, Haoran Li, Xin Liu, Yaran Chen, Ke Chen, Dongbin Zhao
2025ICRAUncAD: Towards Safe End-to-end Autonomous Driving via Online Map Uncertainty.Pengxuan Yang, Yupeng Zheng, Qichao Zhang, Kefei Zhu, Zebin Xing, Qiao Lin, Yun-Fu Liu, Zhiguo Su, Dongbin Zhao
2025SMCFusionNav: Enhancing Zero-Shot Object-Goal Navigation via 3D Semantic Fusion and Farsight Value Reasoning.Shugao Liu, Qichao Zhang, Haoran Li, Dongbin Zhao
2024IJCNNHigh-quality Synthetic Data is Efficient for Model-based Offline Reinforcement Learning.Qichao Zhang, Xing Fang, Kaixuan Xu, Weixin Zhao, Haoran Li, Dongbin Zhao
2024ICRAMonoOcc: Digging into Monocular Semantic Occupancy Prediction.Yupeng Zheng, Xiang Li, Pengfei Li, Yuhang Zheng, Bu Jin, Chengliang Zhong, Xiaoxiao Long, Hao Zhao, Qichao Zhang
2024WWWUser Response Modeling in Reinforcement Learning for Ads Allocation.Zhiyuan Zhang, Qichao Zhang, Xiaoxu Wu, Xiaowen Shi, Guogang Liao, Yongkang Wang, Xingxing Wang, Dongbin Zhao
2023ICONIPPnP: Integrated Prediction and Planning for Interactive Lane Change in Dense Traffic.Xueyi Liu, Qichao Zhang, Yinfeng Gao, Zhongpu Xia
2023ICRASTEPS: Joint Self-supervised Nighttime Image Enhancement and Depth Estimation.Yupeng Zheng, Chengliang Zhong, Pengfei Li, Huan-ang Gao, Yuhang Zheng, Bu Jin, Ling Wang, Hao Zhao, Guyue Zhou, Qichao Zhang, Dongbin Zhao
2021IJCNNHierarchical Reinforcement Learning-Based Policy Switching Towards Multi-Scenarios Autonomous Driving.Youtian Guo, Qichao Zhang, Junjie Wang, Shasha Liu
2021IJCNNIA-CNN: A generalised interpretable convolutional neural network with attention mechanism.Zhisong Zhang, Yaran Chen, Haoran Li, Qichao Zhang
2020IJCNNRailNet: An Information Aggregation Network for Rail Track Segmentation.Haoran Li, Qichao Zhang, Dongbin Zhao, Yaran Chen
2019IJCNNLane Change Decision-making through Deep Reinforcement Learning with Rule-based Constraints.Junjie Wang, Qichao Zhang, Dongbin Zhao, Yaran Chen
2019IJCNNModel-Free Reinforcement Learning based Lateral Control for Lane Keeping.Qichao Zhang, Rui Luo, Dongbin Zhao, Chaomin Luo, Dianwei Qian
2018ICONIPValue Iteration Algorithm for Optimal Consensus Control of Multi-agent Systems.Qichao Zhang, Dongbin Zhao
2018ICPADSReputation-Based Byzantine Fault-Tolerance for Consortium Blockchain.Kai Lei, Qichao Zhang, Limei Xu, Zhuyun Qi
2018IJCNNDeepSign: Deep Learning based Traffic Sign Recognition.Dong Li, Dongbin Zhao, Yaran Chen, Qichao Zhang
2018IJCNNVisual Navigation with Actor-Critic Deep Reinforcement Learning.Kun Shao, Dongbin Zhao, Yuanheng Zhu, Qichao Zhang
2018IJCNNModel-Free Reinforcement Learning for Fully Cooperative Multi-Agent Graphical Games.Qichao Zhang, Dongbin Zhao, Frank L. Lewis
2017ICONIPOff-Policy Reinforcement Learning for Partially Unknown Nonzero-Sum Games.Qichao Zhang, Dongbin Zhao, Sibo Zhang
2017IJCNNPolicy gradient methods with Gaussian process modelling acceleration.Dong Li, Dongbin Zhao, Qichao Zhang, Chaomin Luo
2016IJCNNModel-free reinforcement learning for nonlinear zero-sum games with simultaneous explorations.Qichao Zhang, Dongbin Zhao, Yuanheng Zhu, Xi Chen
2016IJCNNConvolutional fitted Q iteration for vision-based control problems.Dongbin Zhao, Yuanheng Zhu, Le Lv, Yaran Chen, Qichao Zhang
2015ISNNEvent-Triggered H ∞ Control for Continuous-Time Nonlinear System.Dongbin Zhao, Qichao Zhang, Xiangjun Li, Lingda Kong