Unsupervised Vision-and-Language Pretraining via Retrieval-based Multi-Granular Alignment.
Mingyang Zhou, Licheng Yu, Amanpreet Singh, Mengjiao Wang, Zhou Yu, Ning Zhang
Browse the full CVPR paper archive.
Mingyang Zhou, Licheng Yu, Amanpreet Singh, Mengjiao Wang, Zhou Yu, Ning Zhang
Browse the full CVPR paper archive.