VCGD: Visual Clue Guided Decoding with Caption Model for Mitigating Hallucination in Multimodal Large Language Models.
Guoqing Chen, Fu Zhang, Bingqian Liu, Chenglong Lu, Jingwei Cheng
Browse the full AAAI paper archive.
Guoqing Chen, Fu Zhang, Bingqian Liu, Chenglong Lu, Jingwei Cheng
Browse the full AAAI paper archive.