Skip to content

Reward-Augmented Data Enhances Direct Preference Alignment of LLMs.

Shenao Zhang, Zhihan Liu, Boyi Liu, Yufeng Zhang, Yingxiang Yang, Yongfei Liu, Liyu Chen, Tao Sun, Zhaoran Wang

VenueA*ICML
Year2025
ProceedingsICML

Browse the full ICML paper archive.