Skip to content

Are Large Language Models Reliable Reviewers? A Benchmark for Error Detection in Financial Documents.

Ying He, Zhouhong Gu, Zhecheng Hu, Yubo Zhou, Hao Shen, Jiaqing Liang, Zhaoqian Dai, Ma Shuguang, Fei Yu, Yanghua Xiao, Zhixu Li

VenueA*ACL
Year2026
ProceedingsACL (Findings)

Browse the full ACL paper archive.