Skip to content

CoT-VLA: Visual Chain-of-Thought Reasoning for Vision-Language-Action Models.

Qingqing Zhao, Yao Lu, Moo Jin Kim, Zipeng Fu, Zhuoyang Zhang, Yecheng Wu, Zhaoshuo Li, Qianli Ma, Song Han, Chelsea Finn, Ankur Handa, Tsung-Yi Lin, Gordon Wetzstein, Ming-Yu Liu, Donglai Xiang

VenueA*CVPR
Year2025
ProceedingsCVPR

Browse the full CVPR paper archive.