Skip to content

ReflectRM: Boosting Generative Reward Models via Self-Reflection within a Unified Judgment Framework.

Kai Qin, Liangxin Liu, Yu Liang, Longzheng Wang, Yan Wang, Yueyang Zhang, Long Xia, Zhiyuan Sun, Houde Liu, Daiting Shi

VenueA*ACL
Year2026
ProceedingsACL (1)

Browse the full ACL paper archive.