M³-VQA: A Benchmark for Multimodal, Multi-Entity, Multi-Hop Visual Question Answering.
Jiatong Ma, Longteng Guo, Yuchen Liu, Zijia Zhao, Dongze Hao, Xuanxu Lin, Jing Liu
Browse the full ACL paper archive.
Jiatong Ma, Longteng Guo, Yuchen Liu, Zijia Zhao, Dongze Hao, Xuanxu Lin, Jing Liu
Browse the full ACL paper archive.