| 2025 | Container Workload Prediction Using Deep Domain Adaptation in Transfer Learning. | Yunlan Wang, Yutong Liu, Tianhai Zhao, Mingxuan Liu, Jianhua Gu, Zhengxiong Hou, Chengwen Zhong |
| 2025 | NetSenseML: Network-Adaptive Compression for Efficient Distributed Machine Learning. | Yisu Wang, Xinjiao Li, Ruilong Wu, Huangxun Chen, Dirk Kutscher |
| 2025 | GECKO: A Write-Optimized Adaptive Radix Tree for Disaggregated Memory. | Tianyu Wan, Shijia Gong, Yangyang Hu, Jianxi Chen |
| 2025 | Uniform Dense Blocking for Efficient Sparse LU Factorization in First-Principles Materials Simulation. | Chao Wang, Junshi Chen, Longsheng Song, Haijie Hou, Dongdong Tan, Yueqiang He, Wentiao Wu, Sihan Lu, Hong An |
| 2025 | Near-Optimal Contraction Strategies for the Scalar Product in the Tensor-Train Format. | Atte Torri, Przemyslaw Dominikowski, Brice Pointal, Oguz Kaya, Larcio Lima Pilla, Olivier Coulaud |
| 2025 | Scalable Code Generation for RTL Simulation of Deep Learning Accelerators With MLIR. | Jie Tong, Wan-Luan Lee, Umit Yusuf Ogras, Tsung-Wei Huang |
| 2025 | CGP-Graphless: Towards Efficient Serverless Graph Processing via CPU-GPU Pipelined Collaboration. | Yiming Sun, Jiaqi Zhang, Jie Zhang, Huawei Cao, Xuejun An, Xiaochun Ye |
| 2025 | Wedge-Parallel Triangle Counting for GPUs. | Jeffrey Spaan, Kuan-Hsun Chen, David A. Bader, Ana Lucia Varbanescu |
| 2025 | TSim4CXL: Trace-Driven Simulation Framework for CXL-Based High-Performance Computing Systems. | Jaewoo Son, Youngchul Yoon, Soonhoi Ha |
| 2025 | ARM SVE Unleashed: Performance and Insights Across HPC Applications on Nvidia Grace. | Ruimin Shi, Gabin Schieffer, Maya B. Gokhale, Pei-Hung Lin, Hiren D. Patel, Ivy Peng |
| 2025 | Robustness of Deep Learning Classification to Adversarial Input on GPUs: Asynchronous Parallel Accumulation Is a Source of Vulnerability. | Sanjif Shanmugavelu, Mathieu Taillefumier, Christopher Culver, Vijay Ganesh, Oscar R. Hernandez, Ada Sedova |
| 2025 | External GPU Biconnected Components. | Abhijeet Sahu, Andaluri S. P. V. M. Aditya, G. Ramakrishna, Malleti Sai Nikhil, Kishore Kothapalli, Dip Sankar Banerjee |
| 2025 | Making MPI Collective Operations Visible: Understanding Their Utility and Algorithmic Insights. | Anna-Lena Roth, David James, Michael Kuhn, Dustin Frisch |
| 2025 | iAug: Accelerating Augmentation with Importance Sampling in Deep Neural Network Training. | Rubayet Rahman Rongon, Xuechen Zhang |
| 2025 | Breaking the I/O Barrier: 1.2 Tb/s Ethernet Packet Processing on a GPU. | John W. Romein |
| 2025 | Efficient Pyramidal Analysis of Gigapixel Images on a Decentralized Modest Computer Cluster. | Marie Reinbigler, Rishi Sharma, Rafael Pires, Elisabeth Brunet, Anne-Marie Kermarrec, Catalin I. Fetita |
| 2025 | BATCH-DNN: Adaptive and Dynamic Batching for Multi-DNN Accelerators. | Piyumal Ranawaka, Per Stenstrm |
| 2025 | CSGC: Collaborative File System Garbage Collection with Computational Storage. | Jin Pu, Shengan Zheng, Penghao Sun, Guifeng Wang, Xin Xie, Linpeng Huang |
| 2025 | Auction-Based Placement of Function Chains in the Fog at Scale. | Volodia Parol-Guarino, Nikos Parlavantzas |
| 2025 | WAPA: A Workload-Agnostic CPI-Based Thread-to-Core Allocation Policy. | Marta Navarro, Vicent Pallard-Juli, Salvador Petit, Mara Engracia Gmez, Julio Sahuquillo |
| 2025 | FDHA: Fusion-Driven Heterogeneous Accelerator for Efficient Diffusion Model Inference. | Yudong Mu, Zhihua Fan, Xiaoxia Yao, Wenming Li, Zhiyuan Zhang, Honglie Wang, Xuejun An, Xiaochun Ye |
| 2025 | Disaggregated Design for GPU-Based Volumetric Data Structures. | Massimiliano Meneghin, Ahmed H. Mahmoud |
| 2025 | ARC-V: Vertical Resource Adaptivity for HPC Workloads in Containerized Environments. | Daniel Medeiros, Jeremy J. Williams, Jacob Wahlgren, Leonardo Saud Maia Leite, Ivy Peng |
| 2025 | DCI: An Efficient Workload-Aware Dual-Cache Allocation GNN Inference Acceleration System. | Yi Luo, Yaobin Wang, Qi Wang, Yingchen Song, Huan Wu, Qingfeng Wang, Jun Huang |
| 2025 | ServerlessRec: Fast Serverless Inference for Embedding-Based Recommender Systems with Disaggregated Memory. | Mingxuan Liu, Jianhua Gu, Tianhai Zhao |