| 2026 | Robust Ensemble Log Anomaly Detection for High-performance Parallel and Distributed Computing Systems. | Qinxuan Shi, Zhanglong Yang, Sicong Shao |
| 2026 | Deterministic and Efficient Low Rank Approximation on GPUs. | Lu Shi, Weijie Shen, Ruiyi Zhan, Dajun Huang, Weiwei Xu, Shaoshuai Zhang |
| 2026 | SYCL++: A Unified Programming Framework for Heterogeneous Supercomputers at Scale. | Zitao Shen, Yuyang Jin, Kinman Lei, Zixuan Ma, Wenqiang Wang, Yinuo Wang, Wenhao Zhou, Zhenchuan Chen, Di Wei, Qi Zhang, Fei Wang, Ying Liu, Lin Gan, Jidong Zhai |
| 2026 | Building an LLM Gateway as an RSE: Patterns, Pitfalls, and a Case Study from Public Health Data Discovery. | Pengyin Shan, Marynia Kolak |
| 2026 | GICC: A High-Performance Runtime for GPU-Initiated Communication and Coordination in Modern HPC Systems. | Baodi Shan, Mauricio Araya-Polo, Barbara M. Chapman |
| 2026 | νMG-LPA and νBM-LPA: Memory Efficient GPU-based Label Propagation Algorithms (LPA) for Community Detection. | Subhajit Sahu |
| 2026 | Efficient Tracking of Communities on Evolving Graphs with Leiden Algorithm. | Subhajit Sahu |
| 2026 | Accelerating high-accuracy runtime estimation in adaptive sample selection for parallel scalability analysis with reiforcement learning. | Pedro Rici, Elisa Gabriela Lucena, Samuel Xavier-de-Souza |
| 2026 | POLAR-PIC: A Holistic Framework for Matrixized PIC with Co-Designed Compute, Layout, and Communication. | Yizhuo Rao, Xingjian Cui, Shangzhi Pang, Jiabin Xie, Guangnan Feng, Ziyan Zhang, Jinhui Wei, Languang Gao, Zhenyu Wang, Zhiguang Chen, Yutong Lu |
| 2026 | Decay Driven Multi Objective Optimization for HPC nodes. | Akhilesh Raj, Swann Perarnau, Aniruddha Gokhale |
| 2026 | FluxZK: Scalable and Efficient Zero-Knowledge Proof Computation via GPU Acceleration. | Xinwei Qiang, Liukun Yu, Xiyu Wang, Zhengyi Li, Shixuan Sun, Jingwen Leng, Chen Chen, Jiaping Gui, Zhenzhe Zheng, Jin Dong, Minyi Guo |
| 2026 | SAGA: State-Aware Graph Analytics for Combinatorial Optimization on Dynamic Graphs. | Rohit Prajapati, Prajjwal Nijhara, Dip Sankar Banerjee |
| 2026 | ExCC: External Memory Connected Components on Large Graphs. | Prajjwal Nijhara, Dip Sankar Banerjee |
| 2026 | Towards Transparent Checkpointing with AI-driven Code Generation. | Hai Duc Nguyen, Tekin Bicer, Kyle Chard, Ian T. Foster, Bogdan Nicolae |
| 2026 | Merkle-Tree Weight Snapshot Deduplication for Provenance-Aware Auditing of Neural Network Training. | Kin Wai Ng, Francesco Antici, Nigel Tan, Befikir Bogale, Caleb Han, Florence Tama, Osamu Miyashita, Bogdan Nicolae, Michela Taufer |
| 2026 | ATLAS: Efficient Out-of-Core Inference for Billion-Scale Graph Neural Networks. | Pranjal Naman, Yogesh Simmhan |
| 2026 | Full-Core Fluid-Structure-Interaction Simulation of Nuclear Reactor on CPU+GPU Hybrid Clusters. | Xue Miao, Jue Wang, Qida Lin, Shufei Zhang, Rongqiang Cao, Chunbao Zhou, Ningming Nie, He Bai, Yangang Wang |
| 2026 | Robust I/O Characterization of Machine Learning Workloads Across Performance Analysis Tools. | Zoya Masih, Radita Liem, Julian M. Kunkel |
| 2026 | torch_cufft: Extending PyTorch FFT Capacity with Multi-GPU and Descriptor-Resident cuFFTXt Execution. | Yash Malhotra, Sanmukh Kuppannagari |
| 2026 | Odin: Harnessing Rendering Visibility to Break Global Barriers in Distributed Point-Based Neural Rendering. | Zhenxiang Ma, Zeyu He, Yuanzhen Zhou, Zhenyu Yang, Yuchang Zhang, Miao Tao, Rong Fu, Jidong Zhai, Hengjie Li |
| 2026 | Beyond Fixed Budgets: Characterizing the Inelasticity and Limitations of Tree-of-Thought Reasoning Strategies. | Atkia Mahila, Avinash Maurya, M. Mustafa Rafique, Bogdan Nicolae |
| 2026 | ResiHP: Taming LLM Training Failures with Dynamic Hybrid Parallelism. | Tenghui Ma, Jihu Guo, Wei Gao, Sitian Lu, Zhisheng Ye, Hanjing Wang, Dahua Lin |
| 2026 | Enabling High-Utilization and Low-Contention FaaS: A Request-Level Resource Provisioning Approach. | Runfu Li, Zishu Yu, Yifan Wang, Xiaohui Peng, Ninghui Sun, Zhiwei Xu |
| 2026 | TACO: Efficient Communication Compression of Intermediate Tensors for Scalable Tensor-Parallel LLM Training. | Man Liu, Xingchen Liu, Xingjian Tian, Bing Lu, Shengkai Lyu, Shengquan Yin, Wenjing Huang, Zheng Wei, Hairui Zhao, Guangming Tan, Dingwen Tao |
| 2026 | QProR: An Efficient Framework for Quantity-of-Interest Based Progressive Retrieval with Guaranteed Error Control. | Wenbo Li, Qian Gong, Xuan Wu, Jieyang Chen, Qing Liu, Xubin He, Norbert Podhorszki, Scott Klasky, Xin Liang |