Skip to content

JudgeBoard: Benchmarking and Enhancing Small Language Models for Reasoning Evaluation.

Zhenyu Bi, Gaurav Srivastava, Yang Li, Swastik Roy, Meng Lu, Morteza Ziyadi, Xuan Wang

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.