Skip to content

VILA: On Pre-training for Visual Language Models.

Ji Lin, Hongxu Yin, Wei Ping, Pavlo Molchanov, Mohammad Shoeybi, Song Han

VenueA*CVPR
Year2024
ProceedingsCVPR

Browse the full CVPR paper archive.