Skip to content

Accelerating Sparse Transformer Inference on GPU.

Wenhao Dai, Haodong Deng, Mengfei Rong, Xinyu Yang, Hongyu Liu, Fangxin Liu, Hailong Yang, Qianwen Cao, Qingxiao Sun

VenueBPPoPP
Year2026
ProceedingsPPoPP

Browse the full PPoPP paper archive.