Wenbo Su
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
33
Venues
13
Active years
2015–2026
Best venue rank
A*
Where they publish
Papers
33 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | Think-J: Learning to Think for Generative LLM-as-a-Judge. | Hui Huang, Yancheng He, Hongli Zhou, Rui Zhang, Wei Liu, Weixun Wang, Jiaheng Liu, Wenbo Su |
| 2026 | ACL | CE-RM: A Pointwise Generative Reward Model Optimized via Two-Stage Rollout and Unified Criteria. | Xinyu Hu, Yancheng He, Weixun Wang, Tao Feng, Li Lin, Jiashun Liu, Wenbo Su, Bo Zheng, Xiaojun Wan |
| 2026 | ACL | RAVR: Reference-Answer-guided Variational Reasoning for Large Language Models. | Tianqianjin Lin, Xi Zhao, Xingyao Zhang, Rujiao Long, Yi Xu, Zhuoren Jiang, Wenbo Su, Bo Zheng |
| 2026 | ACL | PretrainRL: Alleviating Factuality Hallucination of Large Language Models at the Beginning. | Langming Liu, Kangtao Lv, Haibin Chen, Weidong Zhang, Yejing Wang, Shilei Liu, Xin Tong, Yujin Yuan, Yongwei Wang, Wenbo Su, Bo Zheng |
| 2026 | ACL | Read As Human: Compressing Context via Parallelizable Close Reading and Skimming. | Jiwei Tang, Shilei Liu, Zhicheng Zhang, Qingsong Lv, Runsong Zhao, Tingwei Lu, Langming Liu, Haibin Chen, Yujin Yuan, Hai-Tao Zheng, Wenbo Su, Bo Zheng |
| 2026 | ACL | SELECting over Tokens: Curating Pre-training Data at Scale via Token Classification. | Xin Tong, Weidong Zhang, Jiaang Li, Haibin Chen, Shilei Liu, Langming Liu, Kangtao Lv, Yujin Yuan, Wenbo Su, Bo Zheng |
| 2026 | ACL | ShopSimulator: Evaluating and Exploring RL-Driven LLM Agent for Shopping Assistants. | Pei Wang, Yanan Wu, Xiaoshuai Song, Weixun Wang, Gengru Chen, Zhongwen Li, Kezhong Yan, Qi Liu, Ken Deng, Shuaibing Zhao, Shaopan Xiong, Xuepeng Liu, Xuefeng Chen, Wanxi Deng, Wenbo Su, Bo Zheng |
| 2026 | ACL | CoMeT: Collaborative Memory Transformer for Efficient Long Context Modeling. | Runsong Zhao, Shilei Liu, Jiwei Tang, Langming Liu, Haibin Chen, Weidong Zhang, Yujin Yuan, Tong Xiao, JingBo Zhu, Wenbo Su, Bo Zheng |
| 2026 | ACL | USB: A Comprehensive and Unified Safety Evaluation Benchmark for Multimodal Large Language Models. | Baolin Zheng, Guanlin Chen, Qingyang Teng, Hongqiong Zhong, Yingshui Tan, Zhendong Liu, Weixun Wang, Jiaheng Liu, Jian Yang, Huiyun Jing, Jincheng Wei, Wenbo Su, Xiaoyong Zhu, Bo Zheng, Kaifu Zhang |
| 2026 | NSDI | RollPacker: Taming Long-Tail Rollouts for RL Post-Training with Tail Batching. | Wei Gao, Yuheng Zhao, Dakai An, Tianyuan Wu, Lunxi Cao, Shaopan Xiong, Ju Huang, Weixun Wang, Siran Yang, Wenbo Su, Jiamang Wang, Lin Qu, Bo Zheng, Wei Wang |
| 2026 | WWW | NEZHA: A Zero-sacrifice and Hyperspeed Decoding Architecture for Generative Recommendations. | Yejing Wang, Shengyu Zhou, Jinyu Lu, Ziwei Liu, Langming Liu, Maolin Wang, Wenlin Zhang, Feng Li, Wenbo Su, Pengjie Wang, Jian Xu, Xiangyu Zhao |
| 2026 | WSDM | Unlocking Scaling Law in Industrial Recommendation Systems with a Three-step Paradigm based Large User Model. | Bencheng Yan, Shilei Liu, Zhiyuan Zeng, Zihao Wang, Yizhen Zhang, Yujin Yuan, Langming Liu, Jiaqi Liu, Di Wang, Wenbo Su, Pengjie Wang, Jian Xu, Bo Zheng |
| 2025 | ACL | See the World, Discover Knowledge: A Chinese Factuality Evaluation for Large Vision Language Models. | Jihao Gu, Yingyao Wang, Pi Bu, Chen Wang, Ziming Wang, Tengtao Song, Donglai Wei, Jiale Yuan, Yingxiu Zhao, Yancheng He, Shilong Li, Jiaheng Liu, Meng Cao, Jun Song, Yingshui Tan, Xiang Li, Wenbo Su, Xiaoyong Zhu, Bo Zheng |
| 2025 | ACL | Chinese SimpleQA: A Chinese Factuality Evaluation for Large Language Models. | Yancheng He, Shilong Li, Jiaheng Liu, Yingshui Tan, Weixun Wang, Hui Huang, Xingyuan Bu, Hangyu Guo, Chengwei Hu, Boren Zheng, Zhuoran Lin, Dekai Sun, Zhicheng Zheng, Wenbo Su, Bo Zheng |
| 2025 | ACL | Can Large Language Models Detect Errors in Long Chain-of-Thought Reasoning? | Yancheng He, Shilong Li, Jiaheng Liu, Weixun Wang, Xingyuan Bu, Ge Zhang, Z. Y. Peng, Zhaoxiang Zhang, Zhicheng Zheng, Wenbo Su, Bo Zheng |
| 2025 | ACL | M2RC-EVAL: Massively Multilingual Repository-level Code Completion Evaluation. | Jiaheng Liu, Ken Deng, Congnan Liu, Jian Yang, Shukai Liu, He Zhu, Peng Zhao, Linzheng Chai, Yanan Wu, Ke Jin, Ge Zhang, Zekun Moore Wang, Guoan Zhang, Yingshui Tan, Bangyu Xiang, Zhaoxiang Zhang, Wenbo Su, Bo Zheng |
| 2025 | ACL | ProgCo: Program Helps Self-Correction of Large Language Models. | Xiaoshuai Song, Yanan Wu, Weixun Wang, Jiaheng Liu, Wenbo Su, Bo Zheng |
| 2025 | ACL | Chinese SafetyQA: A Safety Short-form Factuality Benchmark for Large Language Models. | Yingshui Tan, Boren Zheng, Baihui Zheng, Kerui Cao, Huiyun Jing, Jincheng Wei, Jiaheng Liu, Yancheng He, Wenbo Su, Xiaoyong Zhu, Bo Zheng, Kaifu Zhang |
| 2025 | CIKM | ECKGBench: Benchmarking Large Language Models in E-commerce Leveraging Knowledge Graph. | Langming Liu, Haibin Chen, Yuhao Wang, Yujin Yuan, Shilei Liu, Wenbo Su, Xiangyu Zhao, Bo Zheng |
| 2025 | EMNLP | AIR: Complex Instruction Generation via Automatic Iterative Refinement. | Wei Liu, Yancheng He, Yu Li, Hui Huang, Chengwei Hu, Jiaheng Liu, Shilong Li, Wenbo Su, Bo Zheng |
| 2025 | EMNLP | How to inject knowledge efficiently? Knowledge Infusion Scaling Law for Pre-training Large Language Models. | Kangtao Lv, Haibin Chen, Yujin Yuan, Langming Liu, Shilei Liu, Yongwei Wang, Wenbo Su, Bo Zheng |
| 2025 | ICLR | MTU-Bench: A Multi-granularity Tool-Use Benchmark for Large Language Models. | Pei Wang, Yanan Wu, Noah Wang, Jiaheng Liu, Xiaoshuai Song, Z. Y. Peng, Ken Deng, Chenchen Zhang, Jiakai Wang, Junran Peng, Ge Zhang, Hangyu Guo, Zhaoxiang Zhang, Wenbo Su, Bo Zheng |
| 2025 | KDD | ChineseEcomQA: A Scalable E-commerce Concept Evaluation Benchmark for Large Language Models. | Haibin Chen, Kangtao Lv, Chengwei Hu, Yanshi Li, Yujin Yuan, Yancheng He, Xingyao Zhang, Langming Liu, Shilei Liu, Wenbo Su, Bo Zheng |
| 2025 | KDD | UQABench: Evaluating User Embedding for Prompting LLMs in Personalized Question Answering. | Langming Liu, Shilei Liu, Yujin Yuan, Yizhen Zhang, Bencheng Yan, Zhiyuan Zeng, Zihao Wang, Jiaqi Liu, Di Wang, Wenbo Su, Pengjie Wang, Jian Xu, Bo Zheng |
| 2025 | KDD | Multi-task Offline Reinforcement Learning for Online Advertising in Recommender Systems. | Langming Liu, Wanyu Wang, Chi Zhang, Bo Li, Hongzhi Yin, Xuetao Wei, Wenbo Su, Bo Zheng, Xiangyu Zhao |
| 2025 | NAACL | 2D-DPO: Scaling Direct Preference Optimization with 2-Dimensional Supervision. | Shilong Li, Yancheng He, Hui Huang, Xingyuan Bu, Jiaheng Liu, Hangyu Guo, Weixun Wang, Jihao Gu, Wenbo Su, Bo Zheng |
| 2024 | ACL | MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues. | Ge Bai, Jie Liu, Xingyuan Bu, Yancheng He, Jiaheng Liu, Zhanhui Zhou, Zhuoran Lin, Wenbo Su, Tiezheng Ge, Bo Zheng, Wanli Ouyang |
| 2024 | ACL | E2-LLM: Efficient and Extreme Length Extension of Large Language Models. | Jiaheng Liu, Zhiqi Bai, Yuanxing Zhang, Chenchen Zhang, Yu Zhang, Ge Zhang, Jiakai Wang, Haoran Que, Yukang Chen, Wenbo Su, Tiezheng Ge, Jie Fu, Wenhu Chen, Bo Zheng |
| 2024 | ACL | ConceptMath: A Bilingual Concept-wise Benchmark for Measuring Mathematical Reasoning of Large Language Models. | Yanan Wu, Jie Liu, Xingyuan Bu, Jiaheng Liu, Zhanhui Zhou, Yuanxing Zhang, Chenchen Zhang, Zhiqi Bai, Haibin Chen, Tiezheng Ge, Wanli Ouyang, Wenbo Su, Bo Zheng |
| 2024 | EMNLP | GraphReader: Building Graph-based Agent to Enhance Long-Context Abilities of Large Language Models. | Shilong Li, Yancheng He, Hangyu Guo, Xingyuan Bu, Ge Bai, Jie Liu, Jiaheng Liu, Xingwei Qu, Yangguang Li, Wanli Ouyang, Wenbo Su, Bo Zheng |
| 2018 | SIGIR | Visualizing and Understanding Deep Neural Networks in CTR Prediction. | Lin Guo, Hui Ye, Wenbo Su, Henhuan Liu, Kai Sun, Hang Xiang |
| 2015 | ICCCN | Modeling and Analysis of Availability in Multi-Tenant SaaS. | Wenbo Su, Qu Liu, Chuang Lin, Sherman X. Shen |
| 2015 | ICWS | SLA-Aware Tenant Placement and Dynamic Resource Provision in SaaS. | Wenbo Su, Jie Hu, Chuang Lin, Sherman X. Shen |