ChatVLA: Unified Multimodal Understanding and Robot Control with Vision-Language-Action Model.
Zhongyi Zhou, Yichen Zhu, Minjie Zhu, Junjie Wen, Ning Liu, Zhiyuan Xu, Weibin Meng, Yaxin Peng, Chaomin Shen, Feifei Feng, Yi Xu
Browse the full EMNLP paper archive.