| 2026 | ACL | HeteroSpec: Leveraging Contextual Heterogeneity for Efficient Speculative Decoding. | Siran Liu, Yang Ye, Qianchao Zhu, Zane Cao, Yongchao He |
| 2026 | EuroSys | Zeppelin: Balancing Variable-length Workloads in Data Parallel Large Model Training. | Chang Chen, Tiancheng Chen, Jiangfei Duan, Qianchao Zhu, Zerui Wang, Qinghao Hu, Peng Sun, Xiuhong Li, Chao Yang, Torsten Hoefler |
| 2025 | ICS | StructILU: Dependency-Preserving Incomplete LU with Hierarchical Parallelism for Structured Grid PDEs on GPUs. | Hao Luo, Qianchao Zhu, Xiaochen Hao, Chunxi Lei, Chengdi Ma, Chenchen Zhang, Yun Liang, Chao Yang |
| 2024 | ASPLOS | Centauri: Enabling Efficient Scheduling for Communication-Computation Overlap in Large Model Training via Communication Partitioning. | Chang Chen, Xiuhong Li, Qianchao Zhu, Jiangfei Duan, Peng Sun, Xingcheng Zhang, Chao Yang |
| 2024 | ICPP | FreeStencil: A Fine-Grained Solver Compiler with Graph and Kernel Optimizations on Structured Meshes for Modern GPUs. | Qianchao Zhu |
| 2022 | ICPP | EasyView: Enabling and Scheduling Tensor Views in Deep Learning Compilers. | Lijuan Jiang, Ping Xu, Qianchao Zhu, Xiuhong Li, Shengen Yan, Xingcheng Zhang, Dahua Lin, Wenjing Ma, Zhouyang Li, Jun Liu, Jinming Ma, Minxi Jin, Chao Yang |
| 2021 | SC | Enabling and scaling the HPCG benchmark on the newest generation Sunway supercomputer with 42 million heterogeneous cores. | Qianchao Zhu, Hao Luo, Chao Yang, Mingshuo Ding, Wanwang Yin, Xinhui Yuan |