Skip to content

Diff-MoE: Efficient Batched MoE Inference with Priority-Driven Differential Expert Caching.

Kexin Li, Wenkan Huang, Qinggang Wang, Long Zheng, Xiaofei Liao, Hai Jin, Jingling Xue

VenueASC
Year2025
ProceedingsSC

Browse the full SC paper archive.