Adversarial Preference Optimization: Enhancing Your Alignment via RM-LLM Game.
Pengyu Cheng, Yifan Yang, Jian Li, Yong Dai, Tianhao Hu, Peixin Cao, Nan Du, Xiaolong Li
Browse the full ACL paper archive.
Pengyu Cheng, Yifan Yang, Jian Li, Yong Dai, Tianhao Hu, Peixin Cao, Nan Du, Xiaolong Li
Browse the full ACL paper archive.