Skip to content

Accelerating Multimodal Large Language Models by Searching Optimal Vision Token Reduction.

Shiyu Zhao, Zhenting Wang, Felix Juefei-Xu, Xide Xia, Miao Liu, Xiaofang Wang, Mingfu Liang, Ning Zhang, Dimitris N. Metaxas, Licheng Yu

VenueA*CVPR
Year2025
ProceedingsCVPR

Browse the full CVPR paper archive.