EvoCoT: Overcoming the Exploration Bottleneck in Reinforcement Learning for LLMs.
Huanyu Liu, Jia Li, Yihong Dong, Chang Yu, Taozhi Chen, Lecheng Wang, Yongding Tao, Bin Gu, Ge Li
Browse the full ACL paper archive.
Huanyu Liu, Jia Li, Yihong Dong, Chang Yu, Taozhi Chen, Lecheng Wang, Yongding Tao, Bin Gu, Ge Li
Browse the full ACL paper archive.