Skip to content

Embodied Scene Understanding for Vision Language Models via MetaVQA.

Weizhen Wang, Chenda Duan, Zhenghao Peng, Yuxin Liu, Bolei Zhou

VenueA*CVPR
Year2025
ProceedingsCVPR

Browse the full CVPR paper archive.