VisCompConText: Scaling Multi-Modal Contexts via Visual Token Compression and Language Model Guidance.
Wenjun Huang, Zhengzhuo Wang, Jiakai Pan, Yuhe Wang, Shengzhi Shen, Jiahao Tang, Chaoxing Zhou, Jianguo Hu
Browse the full ECAI paper archive.
Wenjun Huang, Zhengzhuo Wang, Jiakai Pan, Yuhe Wang, Shengzhi Shen, Jiahao Tang, Chaoxing Zhou, Jianguo Hu
Browse the full ECAI paper archive.