Skip to content

Accelerating LLM Inference with Flexible N:M Sparsity via A Fully Digital Compute-in-Memory Accelerator.

Akshat Ramachandran, Souvik Kundu, Arnab Raha, Shamik Kundu, Deepak K. Mathaikutty, Tushar Krishna

VenueAISLPED
Year2025
ProceedingsISLPED

Browse the full ISLPED paper archive.