Skip to content

Video-XL: Extra-Long Vision Language Model for Hour-Scale Video Understanding.

Yan Shu, Zheng Liu, Peitian Zhang, Minghao Qin, Junjie Zhou, Zhengyang Liang, Tiejun Huang, Bo Zhao

VenueA*CVPR
Year2025
ProceedingsCVPR

Browse the full CVPR paper archive.