| 2026 | SIGIR | Large-Scale Online Learning for Generative List Recommendation in E-commerce: An Environment Policy Optimization Approach. | Yuan Wang, Zhiyu Li, Ang Gao, Changshuo Zhang, Xiao Zhang, Jun Xu, Quan Lin |
| 2026 | SIGIR | Disentangling from Collaborative and Semantic Views: Graph Collaborative Filtering for Q&A Recommendation. | Changshuo Zhang, Teng Shi, Xiao Zhang, Yanping Zheng, Ruobing Xie, Qi Liu, Jun Xu |
| 2025 | CIKM | Towards Unbiased and Real-Time Staytime Prediction for Live Streaming Recommendation. | Haiyuan Zhao, Changshuo Zhang, Yang Wang, Hao Wang, Zhen Ouyang, Bin Yuan, Qinglei Wang, Zuotao Liu |
| 2025 | EMNLP | Reward Mixology: Crafting Hybrid Signals for Reinforcement Learning Driven In-Context Learning. | Changshuo Zhang, Ang Gao, Xiao Zhang, Yong Liu, Deyang Li, Fangchao Liu, Xinyu Zhang |
| 2025 | RecSys | Test-Time Alignment with State Space Model for Tracking User Interest Shifts in Sequential Recommendation. | Changshuo Zhang, Xiao Zhang, Teng Shi, Jun Xu, Ji-Rong Wen |
| 2025 | WWW | Comment Staytime Prediction with LLM-enhanced Comment Understanding. | Changshuo Zhang, Zihan Lin, Shukai Liu, Yongqi Liu, Han Li |
| 2024 | RecSys | Do Not Wait: Learning Re-Ranking Model Without User Feedback At Serving Time in E-Commerce. | Yuan Wang, Zhiyu Li, Changshuo Zhang, Sirui Chen, Xiao Zhang, Jun Xu, Quan Lin |
| 2024 | SIGIR | Reinforcing Long-Term Performance in Recommender Systems with User-Oriented Exploration Policy. | Changshuo Zhang, Sirui Chen, Xiao Zhang, Sunhao Dai, Weijie Yu, Jun Xu |
| 2023 | KDD | Controllable Multi-Objective Re-ranking with Policy Hypernetworks. | Sirui Chen, Yuan Wang, Zijing Wen, Zhiyu Li, Changshuo Zhang, Xiao Zhang, Quan Lin, Cheng Zhu, Jun Xu |