Skip to content

FLASH: Low-Latency Serverless Model Inference with Multi-Core Parallelism in Edge.

Yanbo Li, Yanying Lin, Shijie Peng, Yingfei Tang, Tian Xiang, Wei Song, Kejiang Ye

VenueBICPADS
Year2023
ProceedingsICPADS

Browse the full ICPADS paper archive.