B-VLLM: A Vision Large Language Model with Balanced Spatio-Temporal Tokens.
Zhuqiang Lu, Zhenfei Yin, Mengwei He, Zhihui Wang, Zicheng Liu, Zhiyong Wang, Kun Hu
Browse the full ICCV paper archive.
Zhuqiang Lu, Zhenfei Yin, Mengwei He, Zhihui Wang, Zicheng Liu, Zhiyong Wang, Kun Hu
Browse the full ICCV paper archive.