Skip to content

LEPO: Latent Reasoning Policy Optimization for Large Language Models.

Yuyan Zhou, Jiarui Yu, Hande Dong, Zhezheng Hao, Hong Wang, Jianqing Zhang, Qiang Lin

VenueA*ACL
Year2026
ProceedingsACL (Findings)

Browse the full ACL paper archive.