Augmenting Multimodal LLMs with Self-Reflective Tokens for Knowledge-based Visual Question Answering.
Federico Cocchi, Nicholas Moratelli, Marcella Cornia, Lorenzo Baraldi, Rita Cucchiara
Browse the full CVPR paper archive.
Federico Cocchi, Nicholas Moratelli, Marcella Cornia, Lorenzo Baraldi, Rita Cucchiara
Browse the full CVPR paper archive.