Skip to content

Zhenpeng Su

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

11

Venues

5

Active years

2023–2026

Best venue rank

A*

Where they publish

Papers

11 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLGood Reasoning Makes Good Demonstrations: Implicit Reasoning Quality Supervision via In-Context Reinforcement Learning.Tiehua Mei, Minxuan Lv, Leiyu Pan, Zhenpeng Su, Hongru Hou, Hengrui Chen, Ao Xu, Deqing Yang
2026ACLCE-GPPO: Coordinating Entropy via Gradient-Preserving Clipping Policy Optimization in Reinforcement Learning.Zhenpeng Su, Leiyu Pan, Minxuan Lv, Yuntao Li, Wenping Hu, Fuzheng Zhang, Kun Gai, Guorui Zhou
2026ACLEntropy Ratio Clipping as a Soft Global Constraint for Stable Reinforcement Learning.Zhenpeng Su, Leiyu Pan, Minxuan Lv, Tiehua Mei, Zijia Lin, Yuntao Li, Wenping Hu, Ruiming Tang, Kun Gai, Guorui Zhou
2025AAAIScaffold-BPE: Enhancing Byte Pair Encoding for Large Language Models with Simple and Effective Scaffold Token Removal.Haoran Lian, Yizhe Xiong, Jianwei Niu, Shasha Mo, Zhenpeng Su, Zijia Lin, Hui Chen, Jungong Han, Guiguang Ding
2025AAAITask-level Distributionally Robust Optimization for Large Language Model-based Dense Retrieval.Guangyuan Ma, Yongliang Ma, Xing Wu, Zhenpeng Su, Ming Zhou, Songlin Hu
2025EMNLPDSMoE: Matrix-Partitioned Experts with Dynamic Routing for Computation-Efficient Dense LLMs.Minxuan Lv, Zhenpeng Su, Leiyu Pan, Yizhe Xiong, Zijia Lin, Hui Chen, Wei Zhou, Jungong Han, Guiguang Ding, Wenwu Ou, Di Zhang, Kun Gai, Songlin Hu
2025EMNLPTemporal Scaling Law for Large Language Models.Yizhe Xiong, Xiansheng Chen, Xin Ye, Hui Chen, Zijia Lin, Haoran Lian, Zhenpeng Su, Wei Huang, Jianwei Niu, Jungong Han, Guiguang Ding
2025NAACLCartesianMoE: Boosting Knowledge Sharing among Experts via Cartesian Product Routing in Mixture-of-Experts.Zhenpeng Su, Xing Wu, Zijia Lin, Yizhe Xiong, Minxuan Lv, Guangyuan Ma, Hui Chen, Songlin Hu, Guiguang Ding
2024NAACLDial-MAE: ConTextual Masked Auto-Encoder for Retrieval-based Dialogue Systems.Zhenpeng Su, Xing Wu, Wei Zhou, Guangyuan Ma, Songlin Hu
2024NAACLMiLe Loss: a New Loss for Mitigating the Bias of Learning Difficulties in Generative Language Models.Zhenpeng Su, Zijia Lin, Bai Xue, Hui Chen, Guiguang Ding, Wei Zhou, Songlin Hu
2023ICASSPT5-SR: A Unified Seq-to-Seq Decoding Strategy for Semantic Parsing.Yuntao Li, Zhenpeng Su, Yutian Li, Hanchu Zhang, Sirui Wang, Wei Wu, Yan Zhang