| 2025 | ASPLOS | Optimizing Deep Learning Inference Efficiency through Block Dependency Analysis. | Zhanyuan Di, Leping Wang, En Shao, Zhaojia Ma, Ziyi Ren, Feng Hua, Lixian Ma, Jie Zhao, Guangming Tan, Ninghui Sun |
| 2025 | PPoPP | Magneto: Accelerating Parallel Structures in DNNs via Co-Optimization of Operators. | Zhanyuan Di, Leping Wang, Ziyi Ren, En Shao, Jie Zhao, Siyuan Feng, Dingwen Tao, Guangming Tan, Ninghui Sun |
| 2024 | HPDC | ElasticRoom: Multi-Tenant DNN Inference Engine via Co-design with Resource-constrained Compilation and Strong Priority Scheduling. | Lixian Ma, Haoruo Chen, En Shao, Leping Wang, Quan Chen, Guangming Tan |
| 2024 | NPC | AsymFB: Accelerating LLM Training Through Asymmetric Model Parallelism. | Jiawei Zhang, En Shao, Leping Wang, Guangming Tan, Ninghui Sun |
| 2024 | PPoPP | POSTER: FineCo: Fine-grained Heterogeneous Resource Management for Concurrent DNN Inferences. | Lixian Ma, Haoruo Chen, En Shao, Leping Wang, Quan Chen, Guangming Tan |
| 2023 | SOSP | Falcon: Fast OLTP Engine for Persistent Cache and Non-Volatile Memory. | Zhicheng Ji, Kang Chen, Leping Wang, Mingxing Zhang, Yongwei Wu |
| 2010 | HiPC | Power-efficient workload distribution for virtualized server clusters. | Leping Wang, Ying Lu |
| 2008 | RTSS | Efficient Power Management of Heterogeneous Soft Real-Time Clusters. | Leping Wang, Ying Lu |