ROSE: A Reward-Oriented Data Selection Framework for LLM Task-Specific Instruction Tuning.
Yang Wu, Huayi Zhang, Yizheng Jiao, Lin Ma, Xiaozhong Liu, Jinhong Yu, Dongyu Zhang, Dezhi Yu, Wei Xu
Browse the full EMNLP paper archive.
Yang Wu, Huayi Zhang, Yizheng Jiao, Lin Ma, Xiaozhong Liu, Jinhong Yu, Dongyu Zhang, Dezhi Yu, Wei Xu
Browse the full EMNLP paper archive.