Skip to content

PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization.

Zouying Cao, Runze Wang, Yifei Yang, Xinbei Ma, Xiaoyong Zhu, Bo Zheng, Hai Zhao

VenueA*ACL
Year2025
ProceedingsACL (Findings)

Browse the full ACL paper archive.