UniToken: Harmonizing Multimodal Understanding and Generation through Unified Visual Encoding.
Yang Jiao, Haibo Qiu, Zequn Jie, Shaoxiang Chen, Jingjing Chen, Lin Ma, Yu-Gang Jiang
Browse the full CVPR paper archive.
Yang Jiao, Haibo Qiu, Zequn Jie, Shaoxiang Chen, Jingjing Chen, Lin Ma, Yu-Gang Jiang
Browse the full CVPR paper archive.