Skip to content

Thinking in Space: How Multimodal Large Language Models See, Remember, and Recall Spaces.

Jihan Yang, Shusheng Yang, Anjali W. Gupta, Rilyn Han, Li Fei-Fei, Saining Xie

VenueA*CVPR
Year2025
ProceedingsCVPR

Browse the full CVPR paper archive.