Skip to content

Save the Good Prefix: Precise Error Penalization via Process-Supervised RL to Enhance LLM Reasoning.

Haolin Liu, Dian Yu, Sidi Lu, Yujun Zhou, Rui Liu, Zhenwen Liang, Haitao Mi, Chen-Yu Wei, Dong Yu

VenueA*ACL
Year2026
ProceedingsACL (Findings)

Browse the full ACL paper archive.