Multimodal Self-Instruct: Synthetic Abstract Image and Visual Reasoning Instruction Using Language Model.
Wenqi Zhang, Zhenglin Cheng, Yuanyu He, Mengna Wang, Yongliang Shen, Zeqi Tan, Guiyang Hou, Mingqian He, Yanna Ma, Weiming Lu, Yueting Zhuang
Browse the full EMNLP paper archive.