MMIE: Massive Multimodal Interleaved Comprehension Benchmark for Large Vision-Language Models.
Peng Xia, Siwei Han, Shi Qiu, Yiyang Zhou, Zhaoyang Wang, Wenhao Zheng, Zhaorun Chen, Chenhang Cui, Mingyu Ding, Linjie Li, Lijuan Wang, Huaxiu Yao
Browse the full ICLR paper archive.