Pretrained Image-Text Models are Secretly Video Captioners.
Chunhui Zhang, Yiren Jian, Zhongyu Ouyang, Soroush Vosoughi
Browse the full NAACL paper archive.
Chunhui Zhang, Yiren Jian, Zhongyu Ouyang, Soroush Vosoughi
Browse the full NAACL paper archive.