EvdCLIP: Improving Vision-Language Retrieval with Entity Visual Descriptions from Large Language Models.
Guanghao Meng, Sunan He, Jinpeng Wang, Tao Dai, Letian Zhang, Jieming Zhu, Qing Li, Gang Wang, Rui Zhang, Yong Jiang
Browse the full AAAI paper archive.