Toward Scalable Video Narration: A Training-Free Approach Using Multimodal Large Language Models.
Tz-Ying Wu, Tahani Trigui, Sharath Nittur Sridhar, Anand V. Bodas, Subarna Tripathi
Browse the full ICCV paper archive.
Tz-Ying Wu, Tahani Trigui, Sharath Nittur Sridhar, Anand V. Bodas, Subarna Tripathi
Browse the full ICCV paper archive.