| 2026 | ICS | PolyKAN: A High-Performance and Universal GPU Operator Library for Polynomial Kolmogorov-Arnold Networks. | Mingkun Yu, Heming Zhong, Jiazhi Jiang, Dan Huang, Yutong Lu |
| 2026 | PPoPP | ASM-SpMM: Unleashing the Potential of Arm SME for Sparse Matrix Multiplication Acceleration. | Jiazhi Jiang, Xijia Yao, Jiayu Chen, Jinhui Wei, Dan Huang, Yutong Lu |
| 2025 | ICCD | Ghidorah: Fast LLM Inference on Edge with Speculative Decoding and Hetero-Core Parallelism. | Jinhui Wei, Ye Huang, Yuhui Zhou, Jiazhi Jiang, Jiangsu Du |
| 2025 | SIGMOD | Oceanus: Enable SLO-Aware Vertical Autoscaling for Cloud-Native Streaming Services in Tencent. | Zihao Chen, Jiazhi Jiang, Jiangang Liu, Chao Zhang, Yuqi Diao, Yang Li, Hanmei Luo, Peng Chen |
| 2024 | DATE | Communication-Efficient Model Parallelism for Distributed In-Situ Transformer Inference. | Yuanxin Wei, Shengyuan Ye, Jiazhi Jiang, Xu Chen, Dan Huang, Jiangsu Du, Yutong Lu |
| 2024 | EuroPar | Efficient Coupling Streaming AI and Ensemble Simulations on HPC Clusters. | Jiazhi Jiang, Hongbin Zhang, Deyin Liu, Jiangsu Du, Xiaojiao Yao, Jinhui Wei, Pin Chen, Dan Huang, Yutong Lu |
| 2024 | PPoPP | Liger: Interleaving Intra- and Inter-Operator Parallelism for Distributed Large Model Inference. | Jiangsu Du, Jinhui Wei, Jiazhi Jiang, Shenggan Cheng, Dan Huang, Zhiguang Chen, Yutong Lu |
| 2024 | SC | APTMoE: Affinity-Aware Pipeline Tuning for MoE Models on Bandwidth-Constrained GPU Nodes. | Yuanxin Wei, Jiangsu Du, Jiazhi Jiang, Xiao Shi, Xianwei Zhang, Dan Huang, Nong Xiao, Yutong Lu |
| 2023 | DATE | Accelerating Inference of 3D-CNN on ARMMany-core CPU via Hierarchical Model Partition. | Jiazhi Jiang, Zijiang Huang, Dan Huang, Jiangsu Du, Yutong Lu |
| 2023 | ICCD | MixRec: Orchestrating Concurrent Recommendation Model Training on CPU-GPU platform. | Jiazhi Jiang, Rui Tian, Jiangsu Du, Dan Huang, Yutong Lu |
| 2022 | ICPP | Characterizing and Optimizing Transformer Inference on ARM Many-core Processor. | Jiazhi Jiang, Jiangsu Du, Dan Huang, Dongsheng Li, Jiang Zheng, Yutong Lu |
| 2022 | ICS | Handling heavy-tailed input of transformer inference on GPUs. | Jiangsu Du, Jiazhi Jiang, Yang You, Dan Huang, Yutong Lu |