Skip to content

Mending the Holes: Mitigating Reward Hacking in Reinforcement Learning for Multilingual Translation.

Yifeng Liu, Siqi Ouyang, Yatish Hosmane Revanasiddappa, Lei Li

VenueA*ACL
Year2026
ProceedingsACL (Findings)

Browse the full ACL paper archive.