Skip to content

Graph-GRPO: Stabilizing Multi-Agent Topology Learning via Group Relative Policy Optimization.

Yueyang Cang, Xiaoteng Zhang, Erlu Zhao, Zehua Ji, Yuhang Liu, Yuchen He, Zhiyuan Ning, Chen Yijun, Wenge Que, Li Shi

VenueA*ACL
Year2026
ProceedingsACL (Findings)

Browse the full ACL paper archive.