Instruction-Guided Cross-Modal Clustering for Training-Free Visual Token Pruning in Vision-Language Models.
Yunqian Yu, Biao Chen, Yunya Zhang, Tonglan Xie, Mengmeng Jing, Lin Zuo
Browse the full AAAI paper archive.
Yunqian Yu, Biao Chen, Yunya Zhang, Tonglan Xie, Mengmeng Jing, Lin Zuo
Browse the full AAAI paper archive.