Language Models are Causal Knowledge Extractors for Zero-shot Video Question Answering.
Hung-Ting Su, Yulei Niu, Xudong Lin, Winston H. Hsu, Shih-Fu Chang
Browse the full CVPR paper archive.
Hung-Ting Su, Yulei Niu, Xudong Lin, Winston H. Hsu, Shih-Fu Chang
Browse the full CVPR paper archive.