Language-Guided Adaptive Vision Token Pruning for Efficient Multimodal Large Language Models.
Omer Faruk Deniz, Tarik Arici, Fatemeh Sheikholeslami, Burak Gozluklu, Ameni Trabelsi, Suleiman Ali Khan, Yapeng Tian, Latifur Khan
Browse the full PAKDD paper archive.