Skip to content

AgentV-RL: Scaling Reward Modeling with Agentic Verifier.

Jiazheng Zhang, Ziche Fu, Zhiheng Xi, Wenqing Jing, Mingxu Chai, Wei He, Guoqiang Zhang, Chenghao Fan, Chenxin An, Wenxiang Chen, Zhicheng Liu, Haojie Pan, Dingwei Zhu, Tao Gui, Qi Zhang, Xuanjing Huang

VenueA*ACL
Year2026
ProceedingsACL (Findings)

Browse the full ACL paper archive.