Skip to content

FrameFusion: Combining Similarity and Importance for Video Token Reduction on Large Vision Language Models.

Tianyu Fu, Tengxuan Liu, Qinghao Han, Guohao Dai, Shengen Yan, Huazhong Yang, Xuefei Ning, Yu Wang

VenueA*ICCV
Year2025
ProceedingsICCV

Browse the full ICCV paper archive.