Skip to content

CLONE: Customizing LLMs for Efficient Latency-Aware Inference at the Edge.

Chunlin Tian, Xinpeng Qin, Kahou Tam, Li Li, Zijian Wang, Yuanzhe Zhao, Minglei Zhang, Chengzhong Xu

VenueAUSENIX
Year2025
ProceedingsUSENIX ATC

Browse the full USENIX paper archive.