Unified Language-Vision Pretraining in LLM with Dynamic Discrete Visual Tokenization.
Yang Jin, Kun Xu, Liwei Chen, Chao Liao, Jianchao Tan, Quzhe Huang, Bin Chen, Chengru Song, Dai Meng, Di Zhang, Wenwu Ou, Kun Gai, Yadong Mu
Browse the full ICLR paper archive.