Skip to content

Towards Efficient Large Language Model Serving: A Survey on System-Aware KV Cache Optimization.

Jiantong Jiang, Peiyu Yang, Rui Zhang, Feng Liu

VenueA*ACL
Year2026
ProceedingsACL (Findings)

Browse the full ACL paper archive.