LRBench and Judge-R1: Principled Evaluation and Training of LLM-Based Judges for Long-Context Reasoning.
Xinyi Zhao, Haoqi Hu, Ziyu Wang, Jinfeng Xiao
Browse the full ACL paper archive.
Xinyi Zhao, Haoqi Hu, Ziyu Wang, Jinfeng Xiao
Browse the full ACL paper archive.