Skip to content

LongVILA: Scaling Long-Context Visual Language Models for Long Videos.

Yukang Chen, Fuzhao Xue, Dacheng Li, Qinghao Hu, Ligeng Zhu, Xiuyu Li, Yunhao Fang, Haotian Tang, Shang Yang, Zhijian Liu, Yihui He, Hongxu Yin, Pavlo Molchanov, Jan Kautz, Linxi Fan, Yuke Zhu, Yao Lu, Song Han

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.