WikiSeeker: Rethinking the Role of Vision-Language Models in Knowledge-Based Visual Question Answering.
Yingjian Zhu, Xinming Wang, Kun Ding, Ying Wang, Bin Fan, Shiming Xiang
Browse the full ACL paper archive.
Yingjian Zhu, Xinming Wang, Kun Ding, Ying Wang, Bin Fan, Shiming Xiang
Browse the full ACL paper archive.