| 2026 | ACL | Good Reasoning Makes Good Demonstrations: Implicit Reasoning Quality Supervision via In-Context Reinforcement Learning. | Tiehua Mei, Minxuan Lv, Leiyu Pan, Zhenpeng Su, Hongru Hou, Hengrui Chen, Ao Xu, Deqing Yang |
| 2026 | ACL | CE-GPPO: Coordinating Entropy via Gradient-Preserving Clipping Policy Optimization in Reinforcement Learning. | Zhenpeng Su, Leiyu Pan, Minxuan Lv, Yuntao Li, Wenping Hu, Fuzheng Zhang, Kun Gai, Guorui Zhou |
| 2026 | ACL | Entropy Ratio Clipping as a Soft Global Constraint for Stable Reinforcement Learning. | Zhenpeng Su, Leiyu Pan, Minxuan Lv, Tiehua Mei, Zijia Lin, Yuntao Li, Wenping Hu, Ruiming Tang, Kun Gai, Guorui Zhou |
| 2025 | CSCWD | GRAgent: A Generative Retrieval Framework for Action Subspace Selection. | Minxuan Lv, Kun Li, Wei Zhou, Songlin Hu |
| 2025 | EMNLP | DSMoE: Matrix-Partitioned Experts with Dynamic Routing for Computation-Efficient Dense LLMs. | Minxuan Lv, Zhenpeng Su, Leiyu Pan, Yizhe Xiong, Zijia Lin, Hui Chen, Wei Zhou, Jungong Han, Guiguang Ding, Wenwu Ou, Di Zhang, Kun Gai, Songlin Hu |
| 2025 | NAACL | CartesianMoE: Boosting Knowledge Sharing among Experts via Cartesian Product Routing in Mixture-of-Experts. | Zhenpeng Su, Xing Wu, Zijia Lin, Yizhe Xiong, Minxuan Lv, Guangyuan Ma, Hui Chen, Songlin Hu, Guiguang Ding |
| 2023 | EMNLP | MeaeQ: Mount Model Extraction Attacks with Efficient Queries. | Chengwei Dai, Minxuan Lv, Kun Li, Wei Zhou |
| 2023 | EMNLP | CT-GAT: Cross-Task Generative Adversarial Attack based on Transferability. | Minxuan Lv, Chengwei Dai, Kun Li, Wei Zhou, Songlin Hu |