Vista-llama: Reducing Hallucination in Video Language Models via Equal Distance to Visual Tokens.
Fan Ma, Xiaojie Jin, Heng Wang, Yuchen Xian, Jiashi Feng, Yi Yang
Browse the full CVPR paper archive.
Fan Ma, Xiaojie Jin, Heng Wang, Yuchen Xian, Jiashi Feng, Yi Yang
Browse the full CVPR paper archive.