DARM: Distribution-Aware Reward Modeling by Alleviating Biases from Low Preference-Context Dependency Data.
Shaofan Liu, Guoqiang Zhang, Shihan Dou, Huiyuan Zheng, Yiming Zhou, Junjie Ye, Shaowen Wang, Shichun Liu, Jiazheng Zhang, Tao Gui, Qi Zhang, Xuanjing Huang
Browse the full ACL paper archive.