Skip to content

KVPR: Efficient LLM Inference with I/O-Aware KV Cache Partial Recomputation.

Chaoyi Jiang, Lei Gao, Hossein Entezari Zarch, Murali Annavaram

VenueA*ACL
Year2025
ProceedingsACL (Findings)

Browse the full ACL paper archive.