Vision Language Pre-training by Contrastive Learning with Cross-Modal Similarity Regulation.
Chaoya Jiang, Wei Ye, Haiyang Xu, Songfang Huang, Fei Huang, Shikun Zhang
Browse the full ACL paper archive.
Chaoya Jiang, Wei Ye, Haiyang Xu, Songfang Huang, Fei Huang, Shikun Zhang
Browse the full ACL paper archive.