Mix-GEMM: An efficient HW-SW Architecture for Mixed-Precision Quantized Deep Neural Networks Inference on Edge Devices.
Enrico Reggiani, Alessandro Pappalardo, Max Doblas, Miquel Moret, Mauro Olivieri, Osman Sabri Unsal, Adrin Cristal
Browse the full HPCA paper archive.