Skip to content

Accelerating Model Loading in LLM Inference by Programmable Page Cache.

Yubo Liu, Hongbo Li, Xiaojia Huang, Yongfeng Wang, Hanjun Guo, Hui Chen, Yuxin Ren, Ning Jia

VenueAFAST
Year2026
ProceedingsFAST

Browse the full FAST paper archive.