Skip to content

Active Reward Modeling: Adaptive Preference Labeling for Large Language Model Alignment.

Yunyi Shen, Hao Sun, Jean-Francois Ton

VenueA*ICML
Year2025
ProceedingsICML

Browse the full ICML paper archive.