Skip to content

CoMM: A Coherent Interleaved Image-Text Dataset for Multimodal Understanding and Generation.

Wei Chen, Lin Li, Yongqi Yang, Bin Wen, Fan Yang, Tingting Gao, Yu Wu, Long Chen

VenueA*CVPR
Year2025
ProceedingsCVPR

Browse the full CVPR paper archive.