MEUR: A Benchmark for Evaluating Vision-Language Models on Multimodal Event Understanding and Reasoning.
Zimu Wang, Yuqi Wang, Tong Chen, Changyu Zeng, Hongbin Na, Nijia Han, Fuyu Xing, Qi Chen, Qiufeng Wang, Anh Nguyen, Shuihua Wang, Ling Chen, Jionglong Su, Haiyang Zhang, Wei Wang
Browse the full LREC paper archive.