Skip to content

SpatialVLM: Endowing Vision-Language Models with Spatial Reasoning Capabilities.

Boyuan Chen, Zhuo Xu, Sean Kirmani, Brian Ichter, Dorsa Sadigh, Leonidas J. Guibas, Fei Xia

VenueA*CVPR
Year2024
ProceedingsCVPR

Browse the full CVPR paper archive.