Skip to content

AVAM: A Universal Training-Free Adaptive Visual Anchoring Embedded into Multimodal Large Language Model for Multi-Image Question Answering.

Kang Zeng, Guojin Zhong, Jintao Cheng, Jin Yuan, Zhiyong Li

VenueA*ICCV
Year2025
ProceedingsICCV

Browse the full ICCV paper archive.