VQAGuider: Guiding Multimodal Large Language Models to Answer Complex Video Questions.
Yuyan Chen, Jiyuan Jia, Jiaxin Lu, Siyue Li, Yu Guan, Ming Yang, Qingpei Guo
Browse the full ACL paper archive.
Yuyan Chen, Jiyuan Jia, Jiaxin Lu, Siyue Li, Yu Guan, Ming Yang, Qingpei Guo
Browse the full ACL paper archive.