Can Large Vision-Language Models Correct Semantic Grounding Errors By Themselves?
Yuan-Hong Liao, Rafid Mahmood, Sanja Fidler, David Acuna
Browse the full CVPR paper archive.
Yuan-Hong Liao, Rafid Mahmood, Sanja Fidler, David Acuna
Browse the full CVPR paper archive.