Skip to content

AirCache: Activating Inter-Modal Relevancy KV Cache Compression for Efficient Large Vision-Language Model Inference.

Kai Huang, Hao Zou, Bochen Wang, Ye Xi, Zhen Xie, Hao Wang

VenueA*ICCV
Year2025
ProceedingsICCV

Browse the full ICCV paper archive.