Skip to content

GenPRM: Scaling Test-Time Compute of Process Reward Models via Generative Reasoning.

Jian Zhao, Runze Liu, Kaiyan Zhang, Zhimu Zhou, Junqi Gao, Dong Li, Jiafei Lyu, Zhouyi Qian, Biqing Qi, Xiu Li, Bowen Zhou

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.