Skip to content

CaM: Cache Merging for Memory-efficient LLMs Inference.

Yuxin Zhang, Yuxuan Du, Gen Luo, Yunshan Zhong, Zhenyu Zhang, Shiwei Liu, Rongrong Ji

VenueA*ICML
Year2024
ProceedingsICML

Browse the full ICML paper archive.