Skip to content

Adversarial Preference Optimization: Enhancing Your Alignment via RM-LLM Game.

Pengyu Cheng, Yifan Yang, Jian Li, Yong Dai, Tianhao Hu, Peixin Cao, Nan Du, Xiaolong Li

VenueA*ACL
Year2024
ProceedingsACL (Findings)

Browse the full ACL paper archive.