Skip to content

PagedEviction: Structured Block-wise KV Cache Pruning for Efficient Large Language Model Inference.

Krishna Teja Chitty-Venkata, Jie Ye, Siddhisanket Raskar, Anthony Kougkas, Xian-He Sun, Murali Emani, Venkatram Vishwanath, Bogdan Nicolae

VenueAEACL
Year2026
ProceedingsEACL (Findings)

Browse the full EACL paper archive.