Skip to content

SPLIT: QoS-Aware DNN Inference on Shared GPU via Evenly-Sized Model Splitting.

Diaohan Luo, Tian Yu, Yuewen Wu, Heng Wu, Tao Wang, Wenbo Zhang

VenueBICPP
Year2023
ProceedingsICPP

Browse the full ICPP paper archive.