| 2026 | EuroSys | Federated Fine-Tuning of Sparsely-Activated Large Language Models on Resource-Constrained Devices. | Fahao Chen, Jie Wan, Peng Li, Zhou Su, Dongxiao Yu |
| 2026 | INFOCOM | Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement. | Qianli Liu, Kaibin Guo, Zicong Hong, Peng Li, Fahao Chen, Haodong Wang, Jian Lin, Song Guo |
| 2025 | IJCAI | Semi-Clairvoyant Scheduling of Speculative Decoding Requests to Minimize LLM Inference Latency. | Ruixiao Li, Fahao Chen, Peng Li |
| 2025 | INFOCOM | SPIN: Accelerating Large Language Model Inference with Heterogeneous Speculative Models. | Fahao Chen, Peng Li, Tom H. Luan, Zhou Su, Jing Deng |
| 2025 | INFOCOM | Mell: Memory-Efficient Large Language Model Serving via Multi-GPU KV Cache Management. | Qianli Liu, Zicong Hong, Peng Li, Fahao Chen, Song Guo |
| 2023 | DASC | Efficient Scheduling for Multi-Job Federated Learning Systems with Client Sharing. | Boqian Fu, Fahao Chen, Peng Li, Zhou Su |
| 2023 | VTC | Low-Latency Perception Sharing Services for Connected Autonomous Vehicles. | Fahao Chen, Peng Li, Lei Zhong, Dongxiao Yu, Xiuzhen Cheng |
| 2022 | HPDC | Hare: Exploiting Inter-job and Intra-job Parallelism of Distributed Machine Learning on Heterogeneous GPUs. | Fahao Chen, Peng Li, Celimuge Wu, Song Guo |
| 2022 | ICPP | TCB: Accelerating Transformer Inference Services with Request Concatenation. | Boqian Fu, Fahao Chen, Peng Li, Deze Zeng |
| 2021 | HPCC | On-Camera Content Filtering for Real-Time Video Analytics. | Fahao Chen, Peng Li, Celimuge Wu |