Multi-Layer Visual Feature Fusion in Multimodal LLMs: Methods, Analysis, and Best Practices.
Junyan Lin, Haoran Chen, Yue Fan, Yingqi Fan, Xin Jin, Hui Su, Jinlan Fu, Xiaoyu Shen
Browse the full CVPR paper archive.
Junyan Lin, Haoran Chen, Yue Fan, Yingqi Fan, Xin Jin, Hui Su, Jinlan Fu, Xiaoyu Shen
Browse the full CVPR paper archive.