| 2026 | EuroPar | Sparsh: Breaking the Communication Bottleneck in Sequence Parallel Video Diffusion Inference with Predictive Sparse Communication. | Huimin Liu, Haozhe Li, Zhenyi Zheng, Jiangsu Du, Nong Xiao |
| 2026 | IWCMC | Learning-Aided Delay-Doppler Filtering for Integrated Sensing and Communication Receivers. | Jiangsu Du, Chao Zhang |
| 2025 | ASPLOS | Concerto: Automatic Communication Optimization and Scheduling for Large-Scale Deep Learning. | Shenggan Cheng, Shengjie Lin, Lansong Diao, Hao Wu, Siyu Wang, Chang Si, Ziming Liu, Xuanlei Zhao, Jiangsu Du, Wei Lin, Yang You |
| 2025 | DAC | PASK: Cold Start Mitigation for Inference with Proactive and Selective Kernel Loading on GPUs. | Xuanteng Huang, Jiangsu Du, Nong Xiao, XianWei Zhang |
| 2025 | ICCD | AuLoRA: Fine-Grained Loading and Computation Orchestration for Efficient LoRA LLM Serving. | Xiao Shi, Jiangsu Du, Zhiguang Chen, Yutong Lu |
| 2025 | ICCD | Ghidorah: Fast LLM Inference on Edge with Speculative Decoding and Hetero-Core Parallelism. | Jinhui Wei, Ye Huang, Yuhui Zhou, Jiazhi Jiang, Jiangsu Du |
| 2025 | ICPP | TD-Pipe: Temporally-Disaggregated Pipeline Parallelism Architecture for High-Throughput LLM Inference. | Hongbin Zhang, Taosheng Wei, Zhenyi Zheng, Jiangsu Du, Zhiguang Chen, Yutong Lu |
| 2025 | WWW | ORFA: Exploring WebAssembly as a Turing Complete Query Language for Web APIs. | Yuhao Gu, Chunyu Chen, Jiangsu Du, Xiaoxi Zhang, Xianwei Zhang |
| 2025 | SC | gLLM: Global Balanced Pipeline Parallelism Systems for Distributed LLMs Serving with Token Throttling. | Tianyu Guo, Xianwei Zhang, Jiangsu Du, Zhiguang Chen, Nong Xiao, Yutong Lu |
| 2025 | SC | coMtainer: Compilation-assisted HPC Container Images with Enhanced Adaptability. | Yuhao Gu, Haoquan Chen, Xianjie Chen, Jiangsu Du, Zhiguang Chen, Nong Xiao, Xianwei Zhang, Yutong Lu |
| 2024 | DATE | Communication-Efficient Model Parallelism for Distributed In-Situ Transformer Inference. | Yuanxin Wei, Shengyuan Ye, Jiazhi Jiang, Xu Chen, Dan Huang, Jiangsu Du, Yutong Lu |
| 2024 | EuroPar | Efficient Coupling Streaming AI and Ensemble Simulations on HPC Clusters. | Jiazhi Jiang, Hongbin Zhang, Deyin Liu, Jiangsu Du, Xiaojiao Yao, Jinhui Wei, Pin Chen, Dan Huang, Yutong Lu |
| 2024 | INFOCOM | Galaxy: A Resource-Efficient Collaborative Edge AI System for In-situ Transformer Inference. | Shengyuan Ye, Jiangsu Du, Liekang Zeng, Wenzhong Ou, Xiaowen Chu, Yutong Lu, Xu Chen |
| 2024 | NPC | Understanding the Inference Performance of Spatial Temporal Diffusion Transformer. | Yu Li, Yuanxin Wei, Jiangsu Du, Dan Huang, Nong Xiao |
| 2024 | PPoPP | Liger: Interleaving Intra- and Inter-Operator Parallelism for Distributed Large Model Inference. | Jiangsu Du, Jinhui Wei, Jiazhi Jiang, Shenggan Cheng, Dan Huang, Zhiguang Chen, Yutong Lu |
| 2024 | SC | APTMoE: Affinity-Aware Pipeline Tuning for MoE Models on Bandwidth-Constrained GPU Nodes. | Yuanxin Wei, Jiangsu Du, Jiazhi Jiang, Xiao Shi, Xianwei Zhang, Dan Huang, Nong Xiao, Yutong Lu |
| 2023 | DATE | Accelerating Inference of 3D-CNN on ARMMany-core CPU via Hierarchical Model Partition. | Jiazhi Jiang, Zijiang Huang, Dan Huang, Jiangsu Du, Yutong Lu |
| 2023 | ICCD | MixRec: Orchestrating Concurrent Recommendation Model Training on CPU-GPU platform. | Jiazhi Jiang, Rui Tian, Jiangsu Du, Dan Huang, Yutong Lu |
| 2022 | ICPP | Characterizing and Optimizing Transformer Inference on ARM Many-core Processor. | Jiazhi Jiang, Jiangsu Du, Dan Huang, Dongsheng Li, Jiang Zheng, Yutong Lu |
| 2022 | ICS | Handling heavy-tailed input of transformer inference on GPUs. | Jiangsu Du, Jiazhi Jiang, Yang You, Dan Huang, Yutong Lu |
| 2020 | ICCD | A Distributed In-Situ CNN Inference System for IoT Applications. | Jiangsu Du, Minghua Shen, Yunfei Du |
| 2019 | HPCC | P-SOBI: A Parallel Implementation for Second Order Blind Identification Algorithm. | Hongbo Li, Jiangsu Du, Yunfei Du, Zhiguang Chen, Nong Xiao |
| 2019 | ICA3PP | Understanding the Resource Demand Differences of Deep Neural Network Training. | Jiangsu Du, Xin Zhu, Nan Hu, Yunfei Du |