Skip to content

Reason in Chains, Learn in Trees: Self-Rectification and Grafting for Multi-turn Agent Policy Optimization.

Yu Li, Sizhe Tang, Tian Lan

VenueA*ACL
Year2026
ProceedingsACL (Findings)

Browse the full ACL paper archive.