CLIP-ViP: Adapting Pre-trained Image-Text Model to Video-Language Alignment.
Hongwei Xue, Yuchong Sun, Bei Liu, Jianlong Fu, Ruihua Song, Houqiang Li, Jiebo Luo
Browse the full ICLR paper archive.
Hongwei Xue, Yuchong Sun, Bei Liu, Jianlong Fu, Ruihua Song, Houqiang Li, Jiebo Luo
Browse the full ICLR paper archive.