LIFBench: Evaluating the Instruction Following Performance and Stability of Large Language Models in Long-Context Scenarios.
Xiaodong Wu, Minhao Wang, Yichen Liu, Xiaoming Shi, He Yan, Xiangju Li, Junmin Zhu, Wei Zhang
Browse the full ACL paper archive.