Skip to content

Planck: Optimizing LLM Inference Performance in Pipeline Parallelism with Fine-Grained SLO Constraint.

Yanying Lin, Shijie Peng, Shuaipeng Wu, Yanbo Li, Chengzhi Lu, Chengzhong Xu, Kejiang Ye

VenueAICWS
Year2024
ProceedingsICWS

Browse the full ICWS paper archive.