End-to-end Generative Pretraining for Multimodal Video Captioning.
Paul Hongsuck Seo, Arsha Nagrani, Anurag Arnab, Cordelia Schmid
Browse the full CVPR paper archive.
Paul Hongsuck Seo, Arsha Nagrani, Anurag Arnab, Cordelia Schmid
Browse the full CVPR paper archive.