Skip to content

Revisiting Entropy in Reinforcement Learning for Large Reasoning Models.

Renren Jin, Pengzhi Gao, Yuqi Ren, Zhuowen Han, Tongxuan Zhang, Wuwei Huang, Wei Liu, Jian Luan, Deyi Xiong

VenueA*ACL
Year2026
ProceedingsACL (Findings)

Browse the full ACL paper archive.