Skip to content

SlimInfer: Accelerating Long-Context LLM Inference via Dynamic Token Pruning.

Lingkun Long, Rubing Yang, Yushi Huang, Desheng Hui, Ao Zhou, Jianlei Yang

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.