Skip to content

Improving Large Language Models via Fine-grained Reinforcement Learning with Minimum Editing Constraint.

Zhipeng Chen, Kun Zhou, Xin Zhao, Junchen Wan, Fuzheng Zhang, Di Zhang, Ji-Rong Wen

VenueA*ACL
Year2024
ProceedingsACL (Findings)

Browse the full ACL paper archive.