Skip to content

DiffPO: Diffusion-styled Preference Optimization for Inference Time Alignment of Large Language Models.

Ruizhe Chen, Wenhao Chai, Zhifei Yang, Xiaotian Zhang, Ziyang Wang, Tony Q. S. Quek, Joey Tianyi Zhou, Soujanya Poria, Zuozhu Liu

VenueA*ACL
Year2025
ProceedingsACL (1)

Browse the full ACL paper archive.