Skip to content

Instruction-Guided Cross-Modal Clustering for Training-Free Visual Token Pruning in Vision-Language Models.

Yunqian Yu, Biao Chen, Yunya Zhang, Tonglan Xie, Mengmeng Jing, Lin Zuo

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.