Skip to content

GeneralSparse: Bridging the Gap in SpMM for Pruned Large Language Model Inference on GPUs.

Yaoyu Wang, Xiao Guo, Junmin Xiao, De Chen, Guangming Tan

VenueAUSENIX
Year2025
ProceedingsUSENIX ATC

Browse the full USENIX paper archive.