Skip to content

GQSA: Group Quantization and Sparsity for Accelerating Large Language Model Inference.

Chao Zeng, Songwei Liu, Shu Yang, Fangmin Chen, Xing Mei, Lean Fu

VenueBIJCNLP
Year2025
ProceedingsIJCNLP-AACL (long papers)

Browse the full IJCNLP paper archive.