VLMixer: Unpaired Vision-Language Pre-training via Cross-Modal CutMix.
Teng Wang, Wenhao Jiang, Zhichao Lu, Feng Zheng, Ran Cheng, Chengguo Yin, Ping Luo
Browse the full ICML paper archive.
Teng Wang, Wenhao Jiang, Zhichao Lu, Feng Zheng, Ran Cheng, Chengguo Yin, Ping Luo
Browse the full ICML paper archive.