KOR-Bench: Benchmarking Language Models on Knowledge-Orthogonal Reasoning Tasks.
Kaijing Ma, Xeron Du, Yunran Wang, Haoran Zhang, Zhoufutu Wen, Xingwei Qu, Jian Yang, Jiaheng Liu, Minghao Liu, Xiang Yue, Wenhao Huang, Ge Zhang
Browse the full ICLR paper archive.