Skip to content

Vista-llama: Reducing Hallucination in Video Language Models via Equal Distance to Visual Tokens.

Fan Ma, Xiaojie Jin, Heng Wang, Yuchen Xian, Jiashi Feng, Yi Yang

VenueA*CVPR
Year2024
ProceedingsCVPR

Browse the full CVPR paper archive.