Skip to content

MMIU: Multimodal Multi-image Understanding for Evaluating Large Vision-Language Models.

Fanqing Meng, Jin Wang, Chuanhao Li, Quanfeng Lu, Hao Tian, Tianshuo Yang, Jiaqi Liao, Xizhou Zhu, Jifeng Dai, Yu Qiao, Ping Luo, Kaipeng Zhang, Wenqi Shao

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.