Skip to content

Qingpeng Cai

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

37

Venues

12

Active years

2016–2026

Best venue rank

A*

Where they publish

Papers

37 indexed papers, newest first.

YearVenueTitleAuthors
2026DASFAATrackRec: Iterative Alternating Feedback with Chain-of-Thought via Preference Alignment for Recommendation.Yu Xia, Rui Zhong, Zeyu Song, Wei Yang, Junchen Wan, Qingpeng Cai, Chi Lu, Peng Jiang
2026WWWLBM: Hierarchical Large Auto-Bidding Model via Reasoning and Acting.Yewen Li, Zhiyi Lyu, Peng Jiang, Qingpeng Cai, Fei Pan, Bo An, Peng Jiang
2026WWWHierarchical Semantic RL: Tackling the Problem of Dynamic Action Space for RL-based Recommendations.Minmao Wang, Xingchen Liu, Shijie Yi, Likang Wu, Hongke Zhao, Fei Pan, Qingpeng Cai, Peng Jiang
2026WSDMTemporalExpertNet: Cross-Temporal Knowledge Reuse for Promotion-Aware CVR Prediction.Minmao Wang, Rui Zhang, Shijie Yi, Likang Wu, Hongke Zhao, Fei Pan, Qingpeng Cai, Peng Jiang
2025AAAILLM-Powered User Simulator for Recommender System.Zijian Zhang, Shuchang Liu, Ziru Liu, Rui Zhong, Qingpeng Cai, Xiangyu Zhao, Chunxu Zhang, Qidong Liu, Peng Jiang
2025AAAIFlow Factorization for Efficient Generative Flow Networks.Jiashun Liu, Chunhui Li, Cheng-Hao Liu, Dianbo Liu, Qingpeng Cai, Ling Pan
2025ICMLRandom Policy Evaluation Uncovers Policies of Generative Flow Networks.Haoran He, Emmanuel Bengio, Qingpeng Cai, Ling Pan
2025WWWGAS: Generative Auto-bidding with Post-training Search.Yewen Li, Shuai Mao, Jingtong Gao, Nan Jiang, Yunjian Xu, Qingpeng Cai, Fei Pan, Peng Jiang, Bo An
2025WWWValue Function Decomposition in Markov Recommendation Process.Xiaobei Wang, Shuchang Liu, Qingpeng Cai, Xiang Li, Lantao Hu, Han Li, Guangming Xie
2025WWWAURO: Reinforcement Learning for Adaptive User Retention Optimization in Recommender Systems.Zhenghai Xue, Qingpeng Cai, Bin Yang, Lantao Hu, Peng Jiang, Kun Gai, Bo An
2025SIGIRGenerative Auto-Bidding with Value-Guided Explorations.Jingtong Gao, Yewen Li, Shuai Mao, Peng Jiang, Nan Jiang, Yejing Wang, Qingpeng Cai, Fei Pan, Peng Jiang, Kun Gai, Bo An, Xiangyu Zhao
2025SIGIRAgentIR: 2nd Workshop on Agent-based Information Retrieval.Pengyue Jia, Qingpeng Cai, Xiangyu Zhao, Ling Pan, Xin Xin, Jin Huang, Weinan Zhang, Li Zhao, Dawei Yin, Grace Hui Yang
2025WSDMDLCRec: A Novel Approach for Managing Diversity in LLM-Based Recommender Systems.Jiaju Chen, Chongming Gao, Shuai Yuan, Shuchang Liu, Qingpeng Cai, Peng Jiang
2024KDDModeling User Retention through Generative Flow Networks.Ziru Liu, Shuchang Liu, Bin Yang, Zhenghai Xue, Qingpeng Cai, Xiangyu Zhao, Zijian Zhang, Lantao Hu, Han Li, Peng Jiang
2024KDDFuture Impact Decomposition in Request-level Recommendations.Xiaobei Wang, Shuchang Liu, Xueliang Wang, Qingpeng Cai, Lantao Hu, Han Li, Peng Jiang, Kun Gai, Guangming Xie
2024SIGIRAgentIR: 1st Workshop on Agent-based Information Retrieval.Qingpeng Cai, Xiangyu Zhao, Ling Pan, Xin Xin, Jin Huang, Weinan Zhang, Li Zhao, Dawei Yin, Grace Hui Yang
2024SIGIRSequential Recommendation for Optimizing Both Immediate Feedback and Long-term Retention.Ziru Liu, Shuchang Liu, Zijian Zhang, Qingpeng Cai, Xiangyu Zhao, Kesen Zhao, Lantao Hu, Peng Jiang, Kun Gai
2024SIGIRMZijian Zhang, Shuchang Liu, Jiaao Yu, Qingpeng Cai, Xiangyu Zhao, Chunxu Zhang, Ziru Liu, Qidong Liu, Hongwei Zhao, Lantao Hu, Peng Jiang, Kun Gai
2023ICLRResAct: Reinforcing Long-term Engagement in Sequential Recommendation with Residual Actor.Wanqi Xue, Qingpeng Cai, Ruohan Zhan, Dong Zheng, Peng Jiang, Kun Gai, Bo An
2023KDDGenerative Flow Network for Listwise Recommendation.Shuchang Liu, Qingpeng Cai, Zhankui He, Bowen Sun, Julian J. McAuley, Dong Zheng, Peng Jiang, Kun Gai
2023KDDPrefRec: Recommender Systems with Human Preferences for Reinforcing Long-term User Engagement.Wanqi Xue, Qingpeng Cai, Zhenghai Xue, Shuo Sun, Shuchang Liu, Dong Zheng, Peng Jiang, Kun Gai, Bo An
2023WWWReinforcing User Retention in a Billion Scale Short Video Recommender System.Qingpeng Cai, Shuchang Liu, Xueliang Wang, Tianyou Zuo, Wentao Xie, Bin Yang, Dong Zheng, Peng Jiang, Kun Gai
2023WWWTwo-Stage Constrained Actor-Critic for Short Video Recommendation.Qingpeng Cai, Zhenghai Xue, Chi Zhang, Wanqi Xue, Shuchang Liu, Ruohan Zhan, Xueliang Wang, Tianyou Zuo, Wentao Xie, Dong Zheng, Peng Jiang, Kun Gai
2023WWWExploration and Regularization of the Latent Action Space in Recommendation.Shuchang Liu, Qingpeng Cai, Bowen Sun, Yuhao Wang, Ji Jiang, Dong Zheng, Peng Jiang, Kun Gai, Xiangyu Zhao, Yongfeng Zhang
2023WWWMulti-Task Recommendations with Reinforcement Learning.Ziru Liu, Jiejie Tian, Qingpeng Cai, Xiangyu Zhao, Jingtong Gao, Shuchang Liu, Dayou Chen, Tonghao He, Dong Zheng, Peng Jiang, Kun Gai
2022AAAIMAGIC: Multimodal relAtional Graph adversarIal inferenCe for Diverse and Unpaired Text-Based Image Captioning.Wenqiao Zhang, Haochen Shi, Jiannan Guo, Shengyu Zhang, Qingpeng Cai, Juncheng Li, Sihui Luo, Yueting Zhuang
2022CVPRBoostMIS: Boosting Medical Image Semi-supervised Learning with Adaptive Pseudo Labeling and Informative Active Annotation.Wenqiao Zhang, Lei Zhu, James Hallinan, Shengyu Zhang, Andrew Makmur, Qingpeng Cai, Beng Chin Ooi
2022ICDEELDA: Learning Explicit Dual-Interactions for Healthcare Analytics.Qingpeng Cai, Kaiping Zheng, Beng Chin Ooi, Wei Wang, Chang Yao
2020AAAIDeterministic Value-Policy Gradients.Qingpeng Cai, Ling Pan, Pingzhong Tang
2020IJCAIReinforcement Learning with Dynamic Boltzmann Softmax Updates.Ling Pan, Qingpeng Cai, Qi Meng, Wei Chen, Longbo Huang
2019AAAIA Deep Reinforcement Learning Framework for Rebalancing Dockless Bike Sharing Systems.Ling Pan, Qingpeng Cai, Zhixuan Fang, Pingzhong Tang, Longbo Huang
2019AAAIPolicy Optimization with Model-Based Explorations.Feiyang Pan, Qingpeng Cai, Anxiang Zeng, Chun-Xiang Pan, Qing Da, Hua-Lin He, Qing He, Pingzhong Tang
2019WWWPolicy Gradients for Contextual Recommendations.Feiyang Pan, Qingpeng Cai, Pingzhong Tang, Fuzhen Zhuang, Qing He
2018AAAIReinforcement Mechanism Design for Fraudulent Behaviour in e-Commerce.Qingpeng Cai, Aris Filos-Ratsikas, Pingzhong Tang, Yiwei Zhang
2018WWWReinforcement Mechanism Design for e-commerce.Qingpeng Cai, Aris Filos-Ratsikas, Pingzhong Tang, Yiwei Zhang
2016IJCAIFacility Location with Minimax Envy.Qingpeng Cai, Aris Filos-Ratsikas, Pingzhong Tang
2016RecSysMechanism Design for Personalized Recommender Systems.Qingpeng Cai, Aris Filos-Ratsikas, Chang Liu, Pingzhong Tang