Skip to content

IntactKV: Improving Large Language Model Quantization by Keeping Pivot Tokens Intact.

Ruikang Liu, Haoli Bai, Haokun Lin, Yuening Li, Han Gao, Zhengzhuo Xu, Lu Hou, Jun Yao, Chun Yuan

VenueA*ACL
Year2024
ProceedingsACL (Findings)

Browse the full ACL paper archive.