Improving Preference Alignment of LLM with Inference-Free Self-Refinement.
Fukun Ma, Kaibin Tian, Jieting Xue, Xiaoyi Wang, Ye Ma, Quan Chen, Peng Jiang, Lijie Wen
Browse the full EMNLP paper archive.
Fukun Ma, Kaibin Tian, Jieting Xue, Xiaoyi Wang, Ye Ma, Quan Chen, Peng Jiang, Lijie Wen
Browse the full EMNLP paper archive.