Skip to content

PLAIN: Leveraging High Internal Bandwidth in PIM for Accelerating Large Language Model Inference via Mixed-Precision Quantization.

Yiwei Hu, Fangxin Liu, Zongwu Wang, Yilong Zhao, Tao Yang, Li Jiang, Haibing Guan

VenueAICCAD
Year2025
ProceedingsICCAD

Browse the full ICCAD paper archive.