Learning Unified Video-Language Representations via Joint Modeling and Contrastive Learning for Natural Language Video Localization.
Chenhao Cui, Xinnian Liang, Shuangzhi Wu, Zhoujun Li
Browse the full IJCNN paper archive.
Chenhao Cui, Xinnian Liang, Shuangzhi Wu, Zhoujun Li
Browse the full IJCNN paper archive.