Skip to content

Muning Wen

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

10

Venues

6

Active years

2022–2026

Best venue rank

A*

Where they publish

Papers

10 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLProgra: Progress-Aware Reinforcement Learning for Multi-Turn Function Calling.Huacan Chai, Zijie Cao, Maolin Ran, Yingxuan Yang, Jianghao Lin, Xin Peng, Hairui Wang, Renjie Ding, Ziyu Wan, Muning Wen, Weiwen Liu, Weinan Zhang, Fei Huang, Ying Wen
2026ACLAttribution-Based Analysis and Optimization of Modular Agentic Workflows.Yingxuan Yang, Bo Huang, Siyuan Qi, Chao Feng, Haoyi Hu, Yuxuan Zhu, Jinbo Hu, Haoran Zhao, Ziyi He, Xiao Liu, Zongyu Wang, Muning Wen, Lin Qiu, Xuezhi Cao, Xunliang Cai, Yong Yu, Weinan Zhang
2025AAAIAutonomous Goal Detection and Cessation in Reinforcement Learning: A Case Study on Source Term Estimation.Yiwei Shi, Muning Wen, Qi Zhang, Weinan Zhang, Cunjia Liu, Weiru Liu
2025ACLHammerBench: Fine-Grained Function-Calling Evaluation in Real Mobile Assistant Scenarios.Jun Wang, Jiamu Zhou, Xihuai Wang, Xiaoyun Mo, Haoyu Zhang, Qiqiang Lin, Jincheng Jincheng, Muning Wen, Weinan Zhang, Qiuying Peng
2025ECAIDiversity-Aware Self-Paced Data Selection for LLM Fine-Tuning.Yingxuan Yang, Huayi Wang, Muning Wen, Xiaoyun Mo, Qiuying Peng, Jun Wang, Weinan Zhang
2025ICLRRobust Gymnasium: A Unified Modular Benchmark for Robust Reinforcement Learning.Shangding Gu, Laixi Shi, Muning Wen, Ming Jin, Eric Mazumdar, Yuejie Chi, Adam Wierman, Costas J. Spanos
2025ICLRRobust Function-Calling for On-Device Language Model via Function Masking.Qiqiang Lin, Muning Wen, Qiuying Peng, Guanyu Nie, Junwei Liao, Jun Wang, Xiaoyun Mo, Jiamu Zhou, Cheng Cheng, Yin Zhao, Jun Wang, Weinan Zhang
2024ICMLAlphaZero-Like Tree-Search can Guide Large Language Model Decoding and Training.Ziyu Wan, Xidong Feng, Muning Wen, Stephen Marcus McAleer, Ying Wen, Weinan Zhang, Jun Wang
2024SIGIRTRAD: Enhancing LLM Agents with Step-Wise Thought Retrieval and Aligned Decision.Ruiwen Zhou, Yingxuan Yang, Muning Wen, Ying Wen, Wenhao Wang, Chunling Xi, Guoqiang Xu, Yong Yu, Weinan Zhang
2022ICLRTrust Region Policy Optimisation in Multi-Agent Reinforcement Learning.Jakub Grudzien Kuba, Ruiqing Chen, Muning Wen, Ying Wen, Fanglei Sun, Jun Wang, Yaodong Yang