CoMM: A Coherent Interleaved Image-Text Dataset for Multimodal Understanding and Generation.
Wei Chen, Lin Li, Yongqi Yang, Bin Wen, Fan Yang, Tingting Gao, Yu Wu, Long Chen
Browse the full CVPR paper archive.
Wei Chen, Lin Li, Yongqi Yang, Bin Wen, Fan Yang, Tingting Gao, Yu Wu, Long Chen
Browse the full CVPR paper archive.