Skip to content

M³-VQA: A Benchmark for Multimodal, Multi-Entity, Multi-Hop Visual Question Answering.

Jiatong Ma, Longteng Guo, Yuchen Liu, Zijia Zhao, Dongze Hao, Xuanxu Lin, Jing Liu

VenueA*ACL
Year2026
ProceedingsACL (1)

Browse the full ACL paper archive.