Skip to content

EVA: Accelerating LLM Decoding via an Efficient Vector Quantization Architecture.

Bowen Duan, Cong Guo, Chiyue Wei, Haoxuan Shan, Yuzhe Fu, Xinhua Chen, Yifan Xu, Ziyue Zhang, Changchun Zhou, Hai Li, Yiran Chen

VenueA*ISCA
Year2026
ProceedingsISCA

Browse the full ISCA paper archive.