Skip to content

SGDPO: Self-Guided Direct Preference Optimization for Language Model Alignment.

Wenqiao Zhu, Ji Liu, Lulu Wang, Jun Wu, Yulun Zhang

VenueA*ACL
Year2025
ProceedingsACL (Findings)

Browse the full ACL paper archive.