Towards Efficient and Robust Manipulation via Multi-Frame Vision-Language-Action Modeling.
Hao Li, Shuai Yang, Yilun Chen, Xinyi Chen, Xiaoda Yang, Yang Tian, Hanqing Wang, Tai Wang, Dahua Lin, Feng Zhao, Jiangmiao Pang
Browse the full AAAI paper archive.