Skip to content

LLaVA-Grounding: Grounded Visual Chat with Large Multimodal Models.

Hao Zhang, Hongyang Li, Feng Li, Tianhe Ren, Xueyan Zou, Shilong Liu, Shijia Huang, Jianfeng Gao, Leizhang, Chunyuan Li, Jainwei Yang

VenueA*ECCV
Year2024
ProceedingsECCV (43)

Browse the full ECCV paper archive.