Skip to content

Preference-Oriented Supervised Fine-Tuning: Favoring Target Model over Aligned Large Language Models.

Yuchen Fan, Yuzhong Hong, Qiushi Wang, Junwei Bao, Hongfei Jiang, Yang Song

VenueA*AAAI
Year2025
ProceedingsAAAI

Browse the full AAAI paper archive.