Skip to content

ConsistRM: Improving Generative Reward Models via Consistency-Aware Self-Training.

Yu Liang, Liangxin Liu, Longzheng Wang, Yan Wang, Yueyang Zhang, Long Xia, Zhiyuan Sun, Daiting Shi

VenueA*ACL
Year2026
ProceedingsACL (1)

Browse the full ACL paper archive.