Skip to content

LongVALE: Vision-Audio-Language-Event Benchmark Towards Time-Aware Omni-Modal Perception of Long Videos.

Tiantian Geng, Jinrui Zhang, Qingni Wang, Teng Wang, Jinming Duan, Feng Zheng

VenueA*CVPR
Year2025
ProceedingsCVPR

Browse the full CVPR paper archive.