Skip to content

RMB: Comprehensively benchmarking reward models in LLM alignment.

Enyu Zhou, Guodong Zheng, Binghai Wang, Zhiheng Xi, Shihan Dou, Rong Bao, Wei Shen, Limao Xiong, Jessica Fan, Yurong Mou, Rui Zheng, Tao Gui, Qi Zhang, Xuanjing Huang

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.