Skip to content

CLIP-Guided Vision-Language Pre-training for Question Answering in 3D Scenes.

Maria Parelli, Alexandros Delitzas, Nikolas Hars, Georgios Vlassis, Sotiris Anagnostidis, Gregor Bachmann, Thomas Hofmann

VenueA*CVPR
Year2023
ProceedingsCVPR Workshops

Browse the full CVPR paper archive.