RM-Bench: Benchmarking Reward Models of Language Models with Subtlety and Style.
Yantao Liu, Zijun Yao, Rui Min, Yixin Cao, Lei Hou, Juanzi Li
Browse the full ICLR paper archive.
Yantao Liu, Zijun Yao, Rui Min, Yixin Cao, Lei Hou, Juanzi Li
Browse the full ICLR paper archive.