VLASCD: A Visual Language Action Model for Simultaneous Chatting and Decision Making.
Zuojin Tang, Bin Hu, Chenyang Zhao, De Ma, Gang Pan, Bin Liu
Browse the full EMNLP paper archive.
Zuojin Tang, Bin Hu, Chenyang Zhao, De Ma, Gang Pan, Bin Liu
Browse the full EMNLP paper archive.