Skip to content

MobiLoRA: Accelerating LoRA-based LLM Inference on Mobile Devices via Context-aware KV Cache Optimization.

Borui Li, Yitao Wang, Haoran Ma, Ligeng Chen, Jun Xiao, Shuai Wang

VenueA*ACL
Year2025
ProceedingsACL (1)

Browse the full ACL paper archive.