Skip to content

Entropy Scheduling in Reinforcement Learning for Large Language Models.

Xingjin Wang, Howe Tissue, Lu Wang, Linjing Li, Daniel Dajun Zeng

VenueA*ACL
Year2026
ProceedingsACL (Findings)

Browse the full ACL paper archive.