Beyond Length Scaling: Synergizing Breadth and Depth for Generative Reward Models.
Qiyuan Zhang, Yufei Wang, Tianhe Wu, Can Xu, Qingfeng Sun, Kai Zheng, Xue Liu, Chen Ma
Browse the full ACL paper archive.
Qiyuan Zhang, Yufei Wang, Tianhe Wu, Can Xu, Qingfeng Sun, Kai Zheng, Xue Liu, Chen Ma
Browse the full ACL paper archive.