LLaVA-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models.
Feng Li, Renrui Zhang, Hao Zhang, Yuanhan Zhang, Bo Li, Wei Li, Zejun Ma, Chunyuan Li
Browse the full ICLR paper archive.
Feng Li, Renrui Zhang, Hao Zhang, Yuanhan Zhang, Bo Li, Wei Li, Zejun Ma, Chunyuan Li
Browse the full ICLR paper archive.