World to Code: Multi-modal Data Generation via Self-Instructed Compositional Captioning and Filtering.
Jiacong Wang, Bohong Wu, Haiyong Jiang, Xun Zhou, Xin Xiao, Haoyuan Guo, Jun Xiao
Browse the full EMNLP paper archive.
Jiacong Wang, Bohong Wu, Haiyong Jiang, Xun Zhou, Xin Xiao, Haoyuan Guo, Jun Xiao
Browse the full EMNLP paper archive.