Skip to content

VLM2Vec: Training Vision-Language Models for Massive Multimodal Embedding Tasks.

Ziyan Jiang, Rui Meng, Xinyi Yang, Semih Yavuz, Yingbo Zhou, Wenhu Chen

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.