| 2025 | Optimizing Network Resilience Using Domain-Specific Hardware Accelerator for Dynamic Programming. | Ali Mazloum, Sergio Elizalde, Samia Choueiri, Elie F. Kfoury, Jose Gomez, Ali AlSabeh, Jorge Crichigno |
| 2025 | Compression Error Sensitivity Analysis for Different Experts in MoE Model Inference. | Songkai Ma, Zhaorui Zhang, Sheng Di, Benben Liu, Xiaodong Yu, Xiaoyi Lu, Dan Wang |
| 2025 | Numerical Properties and Scalability of s-Step Preconditioned Conjugate Gradient Methods. | Viktoria Mayer, Wilfried N. Gansterer |
| 2025 | MLP-Offload: Multi-Level, Multi-Path Offloading for LLM Pre-training to Break the GPU Memory Wall. | Avinash Maurya, M. Mustafa Rafique, Franck Cappello, Bogdan Nicolae |
| 2025 | Frameworks for Large Language Model Serving in HPC Environments. | Rohan Marwaha, Qinren Zhou, Kastan Day, Asmita Dabholkar, Volodymyr V. Kindratenko |
| 2025 | Bridging FPGA and GPU over PCIe: A Low-Latency Communication Path using AVX-512. | Michele Martinelli, Carlotta Chiarini, Andrea Biagioni, Paolo Cretaro, Ottorino Frezza, Francesca Lo Cicero, Alessandro Lonardo, Pierpaolo Perticaroli, Francesco Simula, Luca Pontisso, Cristian Rossi, Piero Vicini |
| 2025 | An HPC-Inspired Blueprint for a Technology-Agnostic Quantum Middle Layer. | Stefano Markidis, Gilbert Netzer, Luca Pennati, Ivy Peng |
| 2025 | mLR: Scalable Laminography Reconstruction based on Memoization. | Bin Ma, Viktor Nikitin, Xi Wang, Tekin Bicer, Dong Li |
| 2025 | First Practical Experiences Integrating Quantum Computers with HPC Resources: A Case Study With a 20-qubit Superconducting Quantum Computer. | Eric Mansfield, Stefan Seegerer, Panu T. Vesanen, Jorge Echavarria, Muhammad Nufail Farooqi, Burak Mete, Laura Brandon Schulz |
| 2025 | Porting a Fortran plasma simulation to Exascale on AMD GPUs using both OpenMP and Kokkos. | Etienne Malaboeuf, Kevin Obrejan, Mathieu Peybernes, Julien Bigot, Emily Bourne, Virginie Grandgirard |
| 2025 | HPC Digital Twins for Evaluating Scheduling Policies, Incentive Structures and their Impact on Power and Cooling. | Matthias Maiterth, Wesley H. Brewer, Jaya S. Kuruvella, Arunavo Dey, Tanzima Z. Islam, Rashadul Kabir, Kevin Menear, Dmitry Duplyakin, Tapasya Patki, Terry R. Jones, Feiyi Wang |
| 2025 | Reproducibility Report for SC25 Paper C.A.T.S.: Memory and Control Flow Tracing for Whole-Program Performance Analysis. | Kurt H. Maier |
| 2025 | Reproducibility Report for SC25 Paper Optimizing Quantum Circuit Mapping to Reduce Inter-Module Communications in Distributed Architectures. | Kurt H. Maier |
| 2025 | Evaluating HPC Scheduling Strategies for Urgent Workloads. | Ketan Maheshwari, Anderson Borch, Jordan Webb, Brian Etz, Ross Miller, Frdric Suter, Sarp Oral, Rafael Ferreira da Silva |
| 2025 | LangChain-Parsl: Connect Large Language Model Agents to High Performance Computing Resource. | Heng Ma, Alexander Brace, Carlo Siebenschuh, Ian T. Foster, Arvind Ramanathan |
| 2025 | Sparsified Preconditioned Conjugate Gradient Solver on GPUs. | Da Ma, Khalid Ahmad, Kazem Cheshmi, Hari Sundar, Mary W. Hall |
| 2025 | Energy-aware performance portability with OpenMP dynamic variants. | Ayman Bourramouss el Maach, Adrian Munera, Sara Royuela |
| 2025 | A Simulation Framework for Workload Management in Hybrid Quantum-HPC Cloud System. | Waylon Luo, Cheng-Chang Lu, Tong Zhan, Qiang Guan |
| 2025 | Generative Latent Diffusion for Efficient Spatiotemporal Data Reduction. | Xiao Li, Liangji Zhu, Anand Rangarajan, Sanjay Ranka |
| 2025 | Optimizing Data Acquisitions in Multi-Robot Systems. | Yanhao Li, Zijun Xu, Xuanjun Wen, Yanjie Song, Guancheng Li, Shu Yin |
| 2025 | DHAP: Towards Efficient OLAP in a Disaggregated and Heterogeneous Environment. | Guangda Liu, Chenqi Zhang, Yizhou Shan, Hao Feng, Zeke Wang, Shixuan Sun, Minyi Guo, Jieru Zhao |
| 2025 | Assessing Page Reclamation Mechanisms for Linux. | Shaochang Liu, Jie Ren |
| 2025 | Beyond End-to-End: Understanding the Limits of LLMs in Scientific Problem Solving. | Youyuan Liu, Sheng Di, Neil Getty, Tanwi Mallick, Robert Underwood, Sian Jin |
| 2025 | MISA-AKMC : Achieve Kinetic Monte Carlo Simulation of 20 Quadrillion Atoms on GPU Clusters. | Shunde Li, Zhijie Pan, Ningming Nie, Jue Wang, He Bai, Genshen Chu, Yan Zeng, Xinfu He, Yangang Wang, Changjun Hu, Xuebin Chi |
| 2025 | COSMOS: Performance Portable Graph Pattern Matching with Domain-Specific Software Distributed Shared Memory. | Zhiheng Lin, Ke Meng, Changjie Xu, Weichen Cao, Guangming Tan |