Challenging the Boundaries of Reasoning: An Olympiad-Level Math Benchmark for Large Language Models.
Haoxiang Sun, Yingqian Min, Zhipeng Chen, Xin Zhao, Ji-Rong Wen
Browse the full ACL paper archive.
Haoxiang Sun, Yingqian Min, Zhipeng Chen, Xin Zhao, Ji-Rong Wen
Browse the full ACL paper archive.