Skip to content

VLM See, Robot Do: Human Demo Video to Robot Action Plan via Vision Language Model.

Beichen Wang, Juexiao Zhang, Shuwen Dong, Irving Fang, Chen Feng

VenueAIROS
Year2025
ProceedingsIROS

Browse the full IROS paper archive.