| 2026 | Efficient Parallel Algorithms for Hypergraph Matching. | Henrik Reinstdtler, Christian Schulz, Nodari Sitchinava, Fabian Walliser |
| 2026 | Asynchronous Checkpoint for Eventually Consistent Databases. | Raaghav Ravishankar, Sandeep S. Kulkarni, Nitin H. Vaidya |
| 2026 | Adaptive Fault Tolerance in Time-Sensitive Networking. | Wei Quan, Qian Yang, Wenliang Ma, Gang Sun, Hui Yang, Tao Li, Zhigang Sun |
| 2026 | RWIP: Region-Level Write-Intensity Prediction for GPU L2 Cache Based on Hybrid-Retention STT-MRAM. | Yujie Pu, Chen Zhao, Jianfeng An, Wenzhe Zhao, Pengju Ren |
| 2026 | How Much Slack is in a Multiprocessor Schedule? | Alexander Pullen, Maxwell Ferguson, Oliver Sinnen |
| 2026 | A Novel Parallel Strategy for Monte Carlo Simulations in Heterogeneous Distributed Systems. | Fernanda G. O. Passos, Bernardo Lopo Silva, Diego G. Passos, Vinod E. F. Rebello |
| 2026 | Minimizing Communication Costs in Inner Product Toom-Cook Algorithms. | Roy Nissim, Yuval Spiizer |
| 2026 | Machine Learning-Enhanced Resource Optimization for Bioinformatics Workflows in the Cloud. | Robert Nica, Fabian Jetzinger, Stefan Gtz, Germn Molt |
| 2026 | Efficient Parallel Enumeration of Disjoint Minimal Failure-Inducing Subsets. | Erwan Tchaleu Ngankeu, Q. Delamea, Jrme Gurhem, Wilfried Kirschenmann, F. Lemaitre, Bruno Lathuilire |
| 2026 | Performance Portable BLAS3 Micro-Kernel Generator. | Stepan Nassyr, Daniel Seibel, Prateek Chawla, Jayesh Badwaik, Andreas Herten, Dirk Pleiter |
| 2026 | Abstraction at What Cost? Evaluating Python DSLs for Transformer GPU Kernel Primitives on Nvidia Blackwell. | Tanmay Nandanikar, Bartosz Sawicki |
| 2026 | Accelerating Sharded Data Parallelism at Scale with Federated Learning. | Gianluca Mittone, Marco Aldinucci |
| 2026 | Constraint Driven Global Data Layout Optimization for Tensor Expressions. | Yi Miao, Stephen A. Jarvis |
| 2026 | GWBP: Accelerating Weighted Back-Projection for Image Reconstruction via Efficient GPU Parallel Optimization. | Hongbo Miao, Haodong Bian |
| 2026 | Understanding Power Limiting Mechanisms in Modern Processors: A Deep Dive Into Intel RAPL and Turbo Boost Dynamics. | Romial Menra, Guillaume Rosinosky, Remous-Aris Koutsiamanis, Sbastien Bolle, Jean-Marc Menaud |
| 2026 | A Task Parallel Algorithm For Fast Hybridized PDE Solvers. | Joseph Mclaughlin, Brittany A. Erickson, Jee Choi |
| 2026 | X-BQSR: Holistic Acceleration of Base Quality Recalibration for Scalable Genomic Analysis. | Eugenio Marinelli, Ivan Donchev Kabadzhov, Raja Appuswamy |
| 2026 | PTStore (Prefix Tensor Store): Distributed Prefix Caching and Replication for High Throughput Inference Serving. | Meghana Maghyastha, Robert Underwood, Randal C. Burns, Bogdan Nicolae |
| 2026 | CCGS: A Cross-modal Collaborative Gradient Sparsification for Accelerating Distributed Multimodal Model Training. | Shenghui Lu, Waixi Liu, Jinhuang Huang, Jiantao Fu, Qingchun Chen |
| 2026 | Thunder: Efficient Multi-node FHE Acceleration Framework via In-Transit Computation. | Kai Li, Lutan Zhao, Qingyun Niu, Yinhang Zheng, Zhengbang Yang, Boyan Zhao, Lu Gao, Rui Hou |
| 2026 | MARS: Multi-model Aware Real-Time Scheduler for NPU-Coordinated DLI Tasks. | Qing Li, Zhan Zhang, Yuzhou Huo, Decheng Zuo, Yanjun Shu |
| 2026 | MoProteus: LLM-Driven Multi-Version Operator Generation for Energy-Aware Scheduling in Heterogeneous Cloud-Edge Environments. | Yiwen Liu, Haotian Wang, Junshuang Ma, Zicong Wang, Wangdong Yang, Kenli Li |
| 2026 | Sparsh: Breaking the Communication Bottleneck in Sequence Parallel Video Diffusion Inference with Predictive Sparse Communication. | Huimin Liu, Haozhe Li, Zhenyi Zheng, Jiangsu Du, Nong Xiao |
| 2026 | Realizable N:M Sparse Transformer Inference via Search-Kernel Co-design. | Yiming Liu, Wenqi Lou, Zhiguang Wang, Zhiwei Ke, Fengrui Zuo, Chao Wang, Xuehai Zhou |
| 2026 | Velvet: Parallel Divide-and-Conquer in Safe Rust. | Anna Badia Liokouras, Ben van Werkhoven, Rob V. van Nieuwpoort |