Skip to content

ReVisionLLM: Recursive Vision-Language Model for Temporal Grounding in Hour-Long Videos.

Tanveer Hannan, Md Mohaiminul Islam, Jindong Gu, Thomas Seidl, Gedas Bertasius

VenueA*CVPR
Year2025
ProceedingsCVPR

Browse the full CVPR paper archive.