Skip to content

STORM: Token-Efficient Long Video Understanding for Multimodal LLMs.

Jindong Jiang, Xiuyu Li, Zhijian Liu, Muyang Li, Guo Chen, Zhiqi Li, De-An Huang, Guilin Liu, Zhiding Yu, Kurt Keutzer, Sungjin Ahn, Jan Kautz, Hongxu Yin, Yao Lu, Song Han, Wonmin Byeon

VenueA*ICCV
Year2025
ProceedingsICCVW

Browse the full ICCV paper archive.