Skip to content

Improving Reward Model Generalization from Adversarial Process Enhanced Preferences.

Zhilong Zhang, Tian Xu, Xinghao Du, Xingchen Cao, Yihao Sun, Yang Yu

VenueA*ICML
Year2025
ProceedingsICML

Browse the full ICML paper archive.