Skip to content

Discriminative Finetuning of Generative Large Language Models without Reward Models and Human Preference Data.

Siqi Guo, Ilgee Hong, Vicente Balmaseda, Changlong Yu, Liang Qiu, Xin Liu, Haoming Jiang, Tuo Zhao, Tianbao Yang

VenueA*ICML
Year2025
ProceedingsICML

Browse the full ICML paper archive.