Skip to content

Rethinking Reward Modeling in Preference-based Large Language Model Alignment.

Hao Sun, Yunyi Shen, Jean-Francois Ton

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.