TReB: A Comprehensive Benchmark for Evaluating Table Reasoning Capabilities of Large Language Models.
Ce Li, Xiaofan Liu, Zhiyan Song, Ce Chi, Boshen Shi, Chen Zhao, Guanguang Chang, Zhendong Wang, Kexin Yang, Xing Wang, Chao Deng, Junlan Feng
Browse the full SIGIR paper archive.