Skip to content

CRPO: Confidence-Reward Driven Preference Optimization for Machine Translation.

Guofeng Cui, Pichao Wang, Yang Liu, Zemian Ke, Zhu Liu, Vimal Bhat

VenueA*ACL
Year2025
ProceedingsACL (Findings)

Browse the full ACL paper archive.