BOLT: Boost Large Vision-Language Model Without Training for Long-form Video Understanding.
Shuming Liu, Chen Zhao, Tianqi Xu, Bernard Ghanem
Browse the full CVPR paper archive.
Shuming Liu, Chen Zhao, Tianqi Xu, Bernard Ghanem
Browse the full CVPR paper archive.