JudgeBoard: Benchmarking and Enhancing Small Language Models for Reasoning Evaluation.
Zhenyu Bi, Gaurav Srivastava, Yang Li, Swastik Roy, Meng Lu, Morteza Ziyadi, Xuan Wang
Browse the full AAAI paper archive.
Zhenyu Bi, Gaurav Srivastava, Yang Li, Swastik Roy, Meng Lu, Morteza Ziyadi, Xuan Wang
Browse the full AAAI paper archive.