Skip to content

ViLMA: A Zero-Shot Benchmark for Linguistic and Temporal Grounding in Video-Language Models.

Ilker Kesen, Andrea Pedrotti, Mustafa Dogan, Michele Cafagna, Emre Can Acikgoz, Letitia Parcalabescu, Iacer Calixto, Anette Frank, Albert Gatt, Aykut Erdem, Erkut Erdem

VenueA*ICLR
Year2024
ProceedingsICLR

Browse the full ICLR paper archive.