Skip to content

EM-KD: Distilling Efficient Multimodal Large Language Model with Unbalanced Vision Tokens.

Ze Feng, Sen Yang, Boqiang Duan, Wankou Yang, Jingdong Wang

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.