Direct Large Language Model Alignment Through Self-Rewarding Contrastive Prompt Distillation.
Aiwei Liu, Haoping Bai, Zhiyun Lu, Xiang Kong, Simon Wang, Jiulong Shan, Meng Cao, Lijie Wen
Browse the full ACL paper archive.
Aiwei Liu, Haoping Bai, Zhiyun Lu, Xiang Kong, Simon Wang, Jiulong Shan, Meng Cao, Lijie Wen
Browse the full ACL paper archive.