Structural Reward Model: Enhancing Interpretability, Efficiency, and Scalability in Reward Modeling.
Xiaoyu Liu, Di Liang, Hongyu Shan, Peiyang Liu, Yonghao Liu, Muling Wu, Yuntao Li, Xianjie Wu, Li Miao, Jiangrong Shen, Minlong Peng
Browse the full EMNLP paper archive.