Video Language Model Pretraining with Spatio-temporal Masking.
Yue Wu, Zhaobo Qi, Junshu Sun, Yaowei Wang, Qingming Huang, Shuhui Wang
Browse the full CVPR paper archive.
Yue Wu, Zhaobo Qi, Junshu Sun, Yaowei Wang, Qingming Huang, Shuhui Wang
Browse the full CVPR paper archive.