| 2025 | ZTP: A Scalable and Lightweight Privacy-Preserving Blockchain via Scale-Free Quorums and Geometric Fragmentation. | Abdullah Al-Mamun, Dongfang Zhao, Gagan Agrawal, Ahmed Aleroud, Mohamed I. Ibrahem |
| 2025 | A High-Accuracy Sketch for Measuring Low-Entropy Flows in Distributed AI Training. | Jin Wang, Chenye Zhu, Jinbin Hu |
| 2025 | SpiderCache: Semantic-Aware Caching Strategy for DNN Training. | Zesong Wang, Peng Fang, Fang Wang, Hong Jiang, Yimin Lu, Zhan Shi, Dan Feng |
| 2024 | Scratchpad Memory Management for Deep Learning Accelerators. | Stavroula Zouzoula, Mohammad Ali Maleki, Muhammad Waqar Azhar, Pedro Trancoso |
| 2024 | FP16 Acceleration in Structured Multigrid Preconditioner for Real-World Applications. | Yi Zong, Peinan Yu, Haopeng Huang, Wei Xue |
| 2024 | PheCon: Fine-Grained VM Consolidation with Nimble Resource Defragmentation in Public Cloud Platforms. | Jiazhen Zhu, Wenda Tang, Xianglong Meng, Nan Gong, Tianxiang Ai, Guanghui Li, Bin Yu, Xin Yang |
| 2024 | Optimizing Stencil Computation on Multi-core DSPs. | Fugeng Zhu, Xinxin Qi, Peng Zhang, Jianbin Fang, Tao Tang, Yonggang Che, Kainan Yu, Jing Xie, Chun Huang, Jie Ren |
| 2024 | Nebula: An Edge-Cloud Collaborative Learning Framework for Dynamic Edge Environments. | Yan Zhuang, Zhenzhe Zheng, Yunfeng Shao, Bingshuai Li, Fan Wu, Guihai Chen |
| 2024 | FreeStencil: A Fine-Grained Solver Compiler with Graph and Kernel Optimizations on Structured Meshes for Modern GPUs. | Qianchao Zhu |
| 2024 | LpaqHP: A High-Performance FPGA Accelerator for LPAQ Compression. | Weilin Zhu, Wei Tong, Hujun Ge, Zuoxian Zhang, Mengran Zhang, Wen Zhou |
| 2024 | HyperDB: a Novel Key Value Store for Reducing Background Traffic in Heterogeneous SSD Storage. | Ruisong Zhou, Yuzhan Zhang, Chunhua Li, Ke Zhou, Peng Wang, Gong Zhang, Ji Zhang, Guangyu Zhang |
| 2024 | DPC: DPU-accelerated High-Performance File System Client. | Kan Zhong, Zhiwang Yu, Qiao Li, Xianqiang Luo, Linbo Long, Yujuan Tan, Ao Ren, Duo Liu |
| 2024 | Online Scheduling and Pricing for Multi-LoRA Fine-Tuning Tasks. | Ying Zheng, Lei Jiao, Han Yang, Lulu Chen, Ying Liu, Yuxiao Wang, Yuedong Xu, Xin Wang, Zongpeng Li |
| 2024 | DB-SpGEMM: A Massively Distributed Block-Sparse Matrix-Matrix Multiplication for Linear-Scaling DFT Calculations. | Zhong Zheng, Junshi Chen, Yang Zhao, Longsheng Song, Xinming Qin, Hong An |
| 2024 | A Motion Trace Decomposition-based overset grid method for parallel CFD simulations with moving boundaries. | Ran Zhao, Chao Li, Xiaowei Guo, Sen Zhang, Xi Yang, Tao Tang, Canqun Yang |
| 2024 | SpeedCore: Space-efficient and Dependency-aware GPU Parallel Framework for Core Decomposition. | Chen Zhao, Ting Yu, Zhigao Zheng, Yuanyuan Zhu, Song Jin, Bo Du, Dacheng Tao |
| 2024 | Multi-level Load Balancing Strategies for Massively Parallel Smoothed Particle Hydrodynamics Simulation. | Yi Zhang, Ziyu Zhang, Yang Zhao, Junshi Chen, Hong An, Zhanming Wang, Longkui Chen |
| 2024 | Im2col-Winograd: An Efficient and Flexible Fused-Winograd Convolution for NHWC Format on GPUs. | Zhiyi Zhang, Pengfei Zhang, Zhuopin Xu, Bingjie Yan, Qi Wang |
| 2024 | The Blind and the Elephant: A Preference-aware Edge Video Analytics Scheduler for Maximizing System Benefit. | Liang Zhang, Hongzi Zhu, Yunzhe Li, Jiangang Shen, Minyi Guo |
| 2024 | AdCoalescer: An Adaptive Coalescer to Reduce the Inter-Module Traffic in MCM-GPUs. | Xu Zhang, Guangda Zhang, Lu Wang, Shiqing Zhang, Xia Zhao |
| 2024 | Jigsaw: Accelerating SpMM with Vector Sparsity on Sparse Tensor Core. | Kaige Zhang, Xiaoyan Liu, Hailong Yang, Tianyu Feng, Xinyu Yang, Yi Liu, Zhongzhi Luan, Depei Qian |
| 2024 | MIGER: Integrating Multi-Instance GPU and Multi-Process Service for Deep Learning Clusters. | Bowen Zhang, Shuxin Li, Zhuozhao Li |
| 2024 | Revisiting Learned Index with Byte-addressable Persistent Storage. | Rui Zhang, Yukai Huang, Sicheng Liang, Shangyi Sun, Shaonan Ma, Chengying Huan, Lulu Chen, Zhihui Lu, Yang Xu, Ming Yan, Jie Wu |
| 2024 | SyncMalloc: A Synchronized Host-Device Co-Management System for GPU Dynamic Memory Allocation across All Scales. | Jiajian Zhang, Fangyu Wu, Hai Jiang, Guangliang Cheng, Genlang Chen, Qiufeng Wang |
| 2024 | Enhancing Heterogeneous Computing Through OpenMP and GPU Graph. | Chenle Yu, Sara Royuela, Eduardo Quiones |