Skip to content

Self-Play Preference Optimization for Language Model Alignment.

Yue Wu, Zhiqing Sun, Huizhuo Yuan, Kaixuan Ji, Yiming Yang, Quanquan Gu

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.