Skip to content

FAM: Fine-Grained Alignment Matters in Multimodal Embedding Learning with Large Vision-Language Models.

Tianhang Xiang, Yirui Li, Lizhao Liu, Hongyan Zhi, Chuanshen Chen, Qing Du, Mingkui Tan

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.