Skip to content

Sharper and Faster mean Better: Towards More Efficient Vision-Language Model for Hour-scale Long Video Understanding.

Daoze Zhang, Yuze Zhao, Jintao Huang, Yingda Chen

VenueA*ACL
Year2025
ProceedingsACL (1)

Browse the full ACL paper archive.