| 2026 | Taming Dynamic Diffusion LLM Inference through Virtual Static Execution. | Jianian Zhu, Hang Wu, Yinghui Li, Haojie Wang, Ruixuan Li, Jidong Zhai |
| 2026 | ViSim: A Lightweight SpMV Performance Simulator via Statistical and Visual Residual Learning. | Shuo Zhu, Wei Huangfu, Genshen Chu |
| 2026 | SHIRO: Near-Optimal Communication Strategies for Distributed Sparse Matrix Multiplication. | Chen Zhuang, Lingqi Zhang, Benjamin Brock, Du Wu, Peng Chen, Toshio Endo, Satoshi Matsuoka, Mohamed Wahib |
| 2026 | Anchoring Whole-System Persistence and Resilience in CXL. | Yuchen Zhou, Jianping Zeng, Changhee Jung |
| 2026 | SparseServe: Unlocking Parallelism for Dynamic Sparse Attention in Long-Context LLM Serving. | Qihui Zhou, Peiqi Yin, Pengfei Zuo, Chao Wang, James Cheng |
| 2026 | Towards Fully Automated Compiler Backend Generation with Multi-Agent Systems: How Far Are We? | Ming Zhong, Lei Qiu, Lulin Wang, Hongna Geng, Xin Sun, Fang Lv |
| 2026 | EZCache: A Hierarchical Memory System for Zoned Neutral Atom Quantum Computers. | Jiayi Zhong, Yuxin Deng, Hui Jiang, Jiacheng Feng |
| 2026 | SmartCap: Coordinated CPU-GPU Power Capping for Performance-Assurance Energy Efficiency. | Zhong Zheng, Xingfu Wu, Valerie E. Taylor, Michael E. Papka, Zhiling Lan |
| 2026 | HOPO: Accelerating Multimodal Neural Networks Inference via Holistic Parallelism Optimization. | Yujie Zheng, Jingwei Sun, Han Li, Guangzhong Sun, Jing Li |
| 2026 | THAC: Unlocking Performance in Parallel HPC Applications via UQ-Aware Automated Approximation. | Zhenhao Zhao, Qinglin Wang, Bo Yang, Xinhai Chen, Jie Liu, Binglin Wang |
| 2026 | WindStencil: Unleashing GPU Potential for High-Order Stencil Computation in High-Performance Inviscid CFD Simulations. | Xinxin Zhang, Haoyuan Zhang, Xiazhen Liu, Jialin Li, Runfeng Jin, Jian Zhang, Wu Yuan, Shan Liang, Zhonghua Lu |
| 2026 | Look Before You Leap : Precision Instruction Supply via SmartScout. | Xuefeng Zhang, Peng Qu, Tingji Zhang, Fang Su, Zhe Pan, Youhui Zhang |
| 2026 | Compiler-ASR: Bridging the IR-to-Assembly Gap for Compiler Optimization via Architecture-Specific Reward. | Kai Zhang, Shigang Li, Xueying Wang |
| 2026 | PolyKAN: A High-Performance and Universal GPU Operator Library for Polynomial Kolmogorov-Arnold Networks. | Mingkun Yu, Heming Zhong, Jiazhi Jiang, Dan Huang, Yutong Lu |
| 2026 | FHECrafter: A Multi-Agent Framework for Automated Fully Homomorphic Encrypted Tensor Program Generation. | Qiuchu Yu, Ruiyuan Xu, Guangli Li |
| 2026 | HPMD: Enabling Hybrid Parallelism with Multi-Dimensional Adaptive DNN Training. | Gyeongchan Yun, Young-ri Choi |
| 2026 | Memory-Centric Computing: Security Benefits and Challenges of Processing-in-DRAM. | Ismail Emir Yuksel, Fatma Nisa Bostanci, Ataberk Olgun, Onur Mutlu |
| 2026 | DynSpAttn: Efficient Attention via Dual-Side Dynamic Sparsity on Sparse Tensor Cores. | Xiangrui Yu, Ruibo Fan, Zeyu Li, Weile Luo, Gu Gong, Xiaowen Chu |
| 2026 | LayerScope: Predictive Cross-Layer Scheduling for Efficient Multi-Batch MoE Inference on Legacy Servers. | Enda Yu, Dezun Dong, Zhaoning Zhang, Zhe Bai, Weiling Yang, Haojie Wang, Dongsheng Li, Yongwei Wu, Xiangke Liao |
| 2026 | When Noisy Quantum Order Finding Remains Recoverable for Shor's Algorithm. | Qingxin Yang, Stefano Markidis |
| 2026 | CORE-BFS: Communication-Optimized REctangular-partitioned BFS Achieving 160.845 TeraTEPS on Frontier Supercomputer. | Haoshen Yang, Hao Lu, Michael A. Matheson, Feiyi Wang, Hang Liu |
| 2026 | GFAz: State-of-the-Art Graphical Fragment Assembly Compression. | Taolue Yang, Youyuan Liu, Bo Jiang, Xinghua Shi, Sian Jin |
| 2026 | CXL-CCL: Inter-Node Collective GPU-Communication Using a CXL Shared Memory Pool. | Dong Xu, Han Meng, Xinyu Chen, Dengcheng Zhu, Wei Tang, Fei Liu, Liguang Xie, Wu Xiang, Rui Shi, Yue Li, Henry Hu, Hui Zhang, Jianping Jiang, Dong Li |
| 2026 | GRASP: Fine-grained and Adaptive Sampled Simulation for GPU Performance Modeling. | Ruini Xue, Lingwei Chao, Zhenxing Huang, Peilin Cai, Jiangying Xue, Tianyu Xiong |
| 2026 | CipherSkip: Efficient Sparse Matrix Multiplication with FHE. | Wujie Xiong, Hao Zhou, Yutong Ye, Ruoming Jin, Lei Xu |