CoViPAL: Layer-wise Contextualized Visual Token Pruning for Large Vision-Language Models.
Zicong Tang, Ziyang Ma, Suqing Wang, Zuchao Li, Lefei Zhang, Hai Zhao, Yun Li, Qianren Wang
Browse the full EMNLP paper archive.
Zicong Tang, Ziyang Ma, Suqing Wang, Zuchao Li, Lefei Zhang, Hai Zhao, Yun Li, Qianren Wang
Browse the full EMNLP paper archive.