Skip to content

VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation.

Yecheng Wu, Zhuoyang Zhang, Junyu Chen, Haotian Tang, Dacheng Li, Yunhao Fang, Ligeng Zhu, Enze Xie, Hongxu Yin, Li Yi, Song Han, Yao Lu

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.