Skip to content

ShortV: Efficient Multimodal Large Language Models by Freezing Visual Tokens in Ineffective Layers.

Qianhao Yuan, Qingyu Zhang, Yanjiang Liu, Jiawei Chen, Yaojie Lu, Hongyu Lin, Jia Zheng, Xianpei Han, Le Sun

VenueA*ICCV
Year2025
ProceedingsICCV

Browse the full ICCV paper archive.