Skip to content

Leveraging per Image-Token Consistency for Vision-Language Pre-training.

Yunhao Gou, Tom Ko, Hansi Yang, James T. Kwok, Yu Zhang, Mingxuan Wang

VenueA*CVPR
Year2023
ProceedingsCVPR

Browse the full CVPR paper archive.