Skip to content

MECLA: Memory-Compute-Efficient LLM Accelerator with Scaling Sub-matrix Partition.

Yubin Qin, Yang Wang, Zhiren Zhao, Xiaolong Yang, Yang Zhou, Shaojun Wei, Yang Hu, Shouyi Yin

VenueA*ISCA
Year2024
ProceedingsISCA

Browse the full ISCA paper archive.