| 2026 | Exploiting Hybrid Energy Storage to Minimize the Carbon Footprint of AI Data Centers. | Simon Wu, Xiaorui Wang |
| 2026 | Phase-aware Peak Power Reduction for Minimizing the Capital Expense of LLM Inference. | Simon Wu, Yuan Ma, Xiaorui Wang |
| 2026 | Parametric Mappings for Distributed-Memory Tensor Computations. | Botao Wu, Martin Kong |
| 2026 | Scaling AI Computing Sustainably: A Journey Towards Sustainable AI. | Carole-Jean Wu |
| 2026 | DCSM: Enabling Inter-Batch Parallelism for Continuous Subgraph Matching on GPU. | Yihua Wei, Peng Jiang |
| 2026 | Skew-aware Adaptive All-to-allv Algorithms for Dynamic Deep Learning Workloads. | Cunyang Wei, Abhinav Bhatele |
| 2026 | GRASP: Optimizing VLIW Instruction Scheduling via Graph Reinforcement Learning. | Zixu Wang, Weiyuan Tong, Jianbin Fang, Yao Zhang, Wei Wang, Jie Ren, Zhanyong Tang |
| 2026 | Wattchmen: Watching the Wattchers - High Fidelity, Flexible GPU Energy Modeling. | Brandon Tran, Matthias Maiterth, Woong Shin, Matthew D. Sinclair, Shivaram Venkataraman |
| 2026 | OCTANE: Breaking the Neighbor-List Bottleneck in GPU Molecular Dynamics. | Hanieh Toutouni, Suman Chakraborty, Yicheng Tu, Jiajun Huang |
| 2026 | Clutch: High Performance Vector-Scalar Comparison using DRAM via Chunked Temporal Coding. | Daichi Tokuda, Tatsuya Kubo, Ismail Emir Yuksel, Ataberk Olgun, Haocong Luo, Tomoya Nagatani, Geraldo Francisco Oliveira, Abdullah Giray Yagliki, Mohammad Sadrosadati, Onur Mutlu, Shinya Takamaeda-Yamazaki |
| 2026 | Closing the Efficiency Gap: AI Datacenter Co-design Roadmap for Scalable Training of LLMs. | Jesmin Jahan Tithi, Hanjiang Wu, Joongun Park, Avishaii Abuhatzera, Fabrizio Petrini, Tushar Krishna |
| 2026 | RPFC: A Router Partitioning and Forward Channel Routing Framework for 2.5D MCM System. | Sicheng Tao, Zhenjiang Guo, Tianyi Liu, Jian Wang |
| 2026 | CoCache: Accelerating Reads in KV Stores via Cooperative Metadata and Data Cache Management. | Haoting Tang, Wenzhe Zhu, Qingyang Zhang, Jiakun Zhang, Junlin Jiang, Zaigui Zhang, Haijun Zhang, Yongkun Li, Yinlong Xu |
| 2026 | DA-MLAD: Drift-Decomposed Meta-Learning for Continual Log Anomaly Detection in Supercomputing Systems. | Kai Tan, Yangliu Du, Dongyang Zhan, Yang Xie, Haining Yu, Bei Zhao, Hao Liu |
| 2026 | The RISC-V VecR extension: Adding internal registers to RVV. | Mariusz Szczepaniak, Syed Waqar Nabi, Nikela Papadopoulou |
| 2026 | CATS: Correlation-aware Task Scheduling for GPU Power Optimization in AI Data Centers. | Srinivasan Subramaniyan, Xiaorui Wang |
| 2026 | DynLP: Parallel Dynamic Batch Update for Label Propagation in Graph-based Semi-Supervised Learning. | S. M. Shovan, Arindam Khanda, S. M. Ferdous, Sajal K. Das, Mahantesh Halappanavar |
| 2026 | quEStab: Towards Scalable Quantum Circuit Simulation on Multi-GPU using an Extended Stabilizer Formalism. | Hyunjoon Shin, Seokhyeon Lee, Myeongjin Kwak, Yongtae Kim |
| 2026 | An Energy Characterization Study of ML operators in XNNPACK on RISC-V Vector Hardware. | Ruimin Shi, Samuel Miksits, Ron Minnich, Maya B. Gokhale, Ivy Peng |
| 2026 | CKTI: A Domain-Specific Compiler for Lowering CUDA Kernels to Triton-IR. | Changqing Shi, Rui Chen, Yufei Sun, Yicheng Sui, Junyu Zhang, Yudong Xie, Mingda Wang, Shuangpeng Ming, Shuo Zhang, Yuzhi Zhang |
| 2026 | InferFast: Bridging the Gap Between Unstructured LLM Sparsity and Practical GPU Throughput. | Zijie Shen, Weifeng Bu, Kai Sheng, Hao Chen, Xin He |
| 2026 | Lock Shielding: A General Technique for Misuse-Resilient Locks. | Vivek Shahare, Milind Chabbi, Nikhil Hegde |
| 2026 | Addressing Key Challenges in Accelerated Computing for Omics Pipelines. | Bertil Schmidt |
| 2026 | Rudder: Steering Prefetching in Distributed GNN Training using LLM Agents. | Aishwarya Sarkar, Sayan Ghosh, Nathan R. Tallent, Aman Chadha, Tanya G. Roosta, Ali Jannesari |
| 2026 | In-depth data movement characterization of DNA read mapping algorithms. | Berkan Sahin, Ecem Ilgn, Klea Zambaku, Can Alkan |