ComicVQA: A Benchmark for Visual Reasoning in Multimodal LLMs.
Esther Gan, Hannah Brown, David Herel, Kenji Kawaguchi, Min-Yen Kan, Michael Qizhe Shieh
Browse the full ACL paper archive.
Esther Gan, Hannah Brown, David Herel, Kenji Kawaguchi, Min-Yen Kan, Michael Qizhe Shieh
Browse the full ACL paper archive.