Skip to content

Adversarial Preference Learning for Robust LLM Alignment.

Yuanfu Wang, Pengyu Wang, Chenyang Xi, Bo Tang, Junyi Zhu, Wenqiang Wei, Chen Chen, Chao Yang, Jingfeng Zhang, Chaochao Lu, Yijun Niu, Keming Mao, Zhiyu Li, Feiyu Xiong, Jie Hu, Mingchuan Yang

VenueA*ACL
Year2025
ProceedingsACL (Findings)

Browse the full ACL paper archive.