E2E-VLP: End-to-End Vision-Language Pre-training Enhanced by Visual Learning.
Haiyang Xu, Ming Yan, Chenliang Li, Bin Bi, Songfang Huang, Wenming Xiao, Fei Huang
Browse the full ACL paper archive.
Haiyang Xu, Ming Yan, Chenliang Li, Bin Bi, Songfang Huang, Wenming Xiao, Fei Huang
Browse the full ACL paper archive.