Sequence-level Large Language Model Training with Contrastive Preference Optimization.
Zhili Feng, Dhananjay Ram, Cole Hawkins, Aditya Rawal, Jinman Zhao, Sheng Zha
Browse the full NAACL paper archive.
Zhili Feng, Dhananjay Ram, Cole Hawkins, Aditya Rawal, Jinman Zhao, Sheng Zha
Browse the full NAACL paper archive.