Skip to content

From Local Details to Global Context: Advancing Vision-Language Models with Attention-Based Selection.

Lincan Cai, Jingxuan Kang, Shuang Li, Wenxuan Ma, Binhui Xie, Zhida Qin, Jian Liang

VenueA*ICML
Year2025
ProceedingsICML

Browse the full ICML paper archive.