Skip to content

LLaVA-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models.

Feng Li, Renrui Zhang, Hao Zhang, Yuanhan Zhang, Bo Li, Wei Li, Zejun Ma, Chunyuan Li

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.