| 2026 | SMEAtten: Fast and Memory-Efficient Outer Product-Based Attention on ARMv9 CPUs with SME. | Tengyang Zheng, Han Huang, Junru Chen, Xianwei Zhang, Yutong Lu |
| 2026 | G-STAR: GPU-Accelerated Statistical Static Timing Analysis Using Level-by-Level Replication. | Boyang Zhang, Chih-Chun Chang, Yi-Hua Chung, Che Chang, Cheng-Hsiang Chiu, Aditya Das Sarma, Tsung-Wei Huang |
| 2026 | Lyapunov-Guided KV Cache Control for Multi-tenant Edge LLM Servicing. | Haishuo Yu, Winston K. G. Seah, Gang Xu, Xiaodong Xu |
| 2026 | DAG-P: Efficient Fine-Grained Partitioning of Open-Source Transformer Models via Dependency-Aligned Planning. | Chenke Yi, Zhiquan Lai, Shengwei Li, Wei Wang, Yu Tang, Weijie Liu, Dongsheng Li |
| 2026 | FlowGPU: Transparent and Efficient GPU Checkpointing and Restore. | Zehua Yang, Xiao Zheng, Yonghao Zou, Junyang Zhang, Zhisheng Ye, Feng Xie, Xiaolin Wang, Yingwei Luo, Zhenlin Wang, Diyu Zhou |
| 2026 | OmniZK: A Versatile Accelerator Architecture for Zero-Knowledge Proofs. | Zhengbang Yang, Lutan Zhao, Han Liu, Kai Li, Rui Hou |
| 2026 | Moirai: Dependency-Impact-Based Communication Scheduling for Multi-job Distributed Deep Learning Cluster. | Jingbin Yang, Ting Liu, Jinglei Pei, Qinghua Wu, Hongtao Guan |
| 2026 | Accelerating Multi-agent Reinforcement Learning on Heterogeneous Platforms. | Samuel Wiggins, Grace Zgheib, Mahesh A. Iyer, Viktor Prasanna |
| 2026 | SparX: Cache-Aware Sparse Matrix Multiplication Kernels on AMX-Based CPUs. | Ziqi Wang, Dongsheng Li, Huayou Su |
| 2026 | Coordinated Resource Management for Energy-Efficient DNN Inference on Heterogeneous Edge Devices. | Yuening Wang, Juan Fang, Ran Zhai, Qi Ming, Nan He, Anca Jurcut |
| 2026 | Communication Offloading on SmartNIC DPUs: A Quantitative Approach. | Jacob Wahlgren, Andong Hu, Roger Pearce, Maya B. Gokhale, Ivy Peng |
| 2026 | Hierarchical Parallel Computing for Optimal Qubit Mapping in NISQ Systems. | Jean-Philippe Valois, Guillaume Helbecque, Nouredine Melab |
| 2026 | Characterizing GPU Warm-Up Beyond Data Transfers. | Julien Tixier, Dominique Houzet, Virginie Fresse |
| 2026 | Evaluating the Parallelization Capabilities of State-of-the-Art Agentic Large Language Models. | Peter Thoman, Philipp Gschwandtner |
| 2026 | HGNNMap: Heterogeneous Graph Neural Network-Based Mapping for Spatial Accelerators. | Shengzhong Tang, Zhihua Fan, Tianyu Liu, Xuejun An, Xiaochun Ye, Wenming Li |
| 2026 | PeakLife: Proactive VM Management via Joint Forecasting. | Bowen Sun, Christos D. Antonopoulos, Evgenia Smirni, Bin Ren, Nikolaos Bellas, Spyros Lalis |
| 2026 | Layer-Wise CPU-GPU Scheduling for LLM Inference on Memory-Limited Consumer GPUs. | Naoto Sugiura, Yuta Tokusashi, Hiroki Matsutani |
| 2026 | CoDA: Constraint-Based Distance Adjustment Optimization for Distance-Based ISAs. | Shu Sugita, Masumi Aoki, Junichiro Kadomoto, Hidetsugu Irie |
| 2026 | Constella: A Novel Framework for Cost-Efficient Distributed AI Inference in LEO Space Data Centers. | Andrija Stanisic, Milos Gravara, Juan Luis Herrera, Stefan Nastic |
| 2026 | Performance Analysis of Hardware-Accelerated Compressed Memory Swap. | Eunyeong Sim, Woongki Baek |
| 2026 | Closer in the Gap: Towards Portable Performance on RISC-V Vector Processors. | Ruimin Shi, Maya B. Gokhale, Pei-Hung Lin, Xavier Teruel, Ivy Peng |
| 2026 | Characterizing Needleman-Wunsch Sequence Alignment on the Graphcore IPU: Memory Trade-Offs and Optimization Strategies. | S. Kazem Shekofteh, Nils Kochendrfer, Holger Frning |
| 2026 | Carbon-Aware Mapping and Scheduling for Deadline-Constrained Workflows. | Dominik Schweisgut, Anne Benoit, Yves Robert, Henning Meyerhenke |
| 2026 | Taking the Leap: Efficient and Reliable Fine-Grained NUMA Migration in User-Space. | Felix Schuhknecht, Nick Johannes Peter Rassau |
| 2026 | Engineering Scalable Distributed List Ranking. | Peter Sanders, Matthias Schimek, Tim Niklas Uhl, Thomas Weidmann |