Skip to content

LIRE: listwise reward enhancement for preference alignment.

Mingye Zhu, Yi Liu, Lei Zhang, Junbo Guo, Zhendong Mao

VenueA*ACL
Year2024
ProceedingsACL (Findings)

Browse the full ACL paper archive.