Skip to content

EvoCoT: Overcoming the Exploration Bottleneck in Reinforcement Learning for LLMs.

Huanyu Liu, Jia Li, Yihong Dong, Chang Yu, Taozhi Chen, Lecheng Wang, Yongding Tao, Bin Gu, Ge Li

VenueA*ACL
Year2026
ProceedingsACL (Findings)

Browse the full ACL paper archive.