Skip to content

SVLTA: Benchmarking Vision-Language Temporal Alignment via Synthetic Video Situation.

Hao Du, Bo Wu, Yan Lu, Zhendong Mao

VenueA*CVPR
Year2025
ProceedingsCVPR

Browse the full CVPR paper archive.