Enabling Multimodal Generation on CLIP via Vision-Language Knowledge Distillation.
Wenliang Dai, Lu Hou, Lifeng Shang, Xin Jiang, Qun Liu, Pascale Fung
Browse the full ACL paper archive.
Wenliang Dai, Lu Hou, Lifeng Shang, Xin Jiang, Qun Liu, Pascale Fung
Browse the full ACL paper archive.