SPLIT: QoS-Aware DNN Inference on Shared GPU via Evenly-Sized Model Splitting.
Diaohan Luo, Tian Yu, Yuewen Wu, Heng Wu, Tao Wang, Wenbo Zhang
Browse the full ICPP paper archive.
Diaohan Luo, Tian Yu, Yuewen Wu, Heng Wu, Tao Wang, Wenbo Zhang
Browse the full ICPP paper archive.