Skip to content

Video-LLaVA: Learning United Visual Representation by Alignment Before Projection.

Bin Lin, Yang Ye, Bin Zhu, Jiaxi Cui, Munan Ning, Peng Jin, Li Yuan

VenueA*EMNLP
Year2024
ProceedingsEMNLP

Browse the full EMNLP paper archive.