ViLTA: Enhancing Vision-Language Pre-training through Textual Augmentation.
Weihan Wang, Zhen Yang, Bin Xu, Juanzi Li, Yankui Sun
Browse the full ICCV paper archive.
Weihan Wang, Zhen Yang, Bin Xu, Juanzi Li, Yankui Sun
Browse the full ICCV paper archive.