| 2024 | Performance = Implementation + Hardware + Input Data, with application to SpMV. | Khushboo Chaudhari, Shrirang Karandikar, Sneha Thombre |
| 2024 | Performance Enhancement of Cyber Range through HPC: Issues and Challenges. | Durbadal Chattaraj, Srihari K. B, Bansidharee Maji |
| 2024 | Impact of Constraint Modifications on the CRYSTALS-Kyber Hardware Design. | Dixit Dutt Bohra, Dip Sankar Banerjee, Somitra Sanadhya |
| 2024 | Allocation Strategies for Disaggregated Memory in HPC Systems. | Robin Bozennec, Danilo Carastan-Santos, Fanny Dufoss, Guillaume Pallez |
| 2024 | Utilization of HPC for Designing Modern Cryptographic Protocols: Analysis and Observation. | Srihari K. B, Bansidharee Maji, Durbadal Chattaraj |
| 2024 | A GPU-based Method for Finding Optimal Solution to the Set Covering Problem. | Girish Biswas, Nandini Mukherjee |
| 2024 | Building a portable parallel asynchronous PDE solver using Kokkos. | Ranjan Bhat, Konduri Aditya |
| 2024 | When Less is More: Achieving Faster Convergence in Distributed Edge Machine Learning. | Advik Raj Basani, Siddharth Chaitra Vivek, Advaith Krishna, Arnab K. Paul |
| 2024 | HiPC 2024 WORKSHOP 3: 1st Workshop on AI for Scientific and General Purpose Computing (AI-SPC 2024). | Subhasis Banerjee, Pradeep Rao |
| 2024 | Performance Efficiency of Image Processing Algorithms on GPU using GPU specific languages. | Smit Bagul, Akshat Singh, Surya Prasad S, Pradeep Ramachandran, Rupesh Nasre |
| 2024 | Asynchrony-Tolerant Schemes to Enhance Scalability of High-Order Compressible Flow Solver. | Aswin Kumar A, Nagabhushana Rao Vadlamani, Konduri Aditya |
| 2024 | A Preliminary Performance Analysis of LLM Inference on Edge Accelerators. | Mayank Arya, Yogesh Simmhan |
| 2024 | Study of CXL Memory Sharing with FamFS and its Use cases. | Ramesh Aravind, Groves John |
| 2024 | HyperSack: Distributed Hyperparameter Optimization for Deep Learning using Resource-Aware Scheduling on Heterogeneous GPU Systems. | Nawras Alnaasan, Bharath Ramesh, Jinghan Yao, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda |
| 2024 | Random Adaptive Cache Placement Policy. | Vrushank Ahire, Pranav Menon, Aniruddh Muley, Abhinandan S. Prasad |
| 2024 | Adaptive Threshold Determination for Temporal Sampling during Smart In-Situ Visualization. | Kazuya Adachi, Taisei Matsushima, Naohisa Sakamoto, Jorji Nonaka, Chongke Bi |
| 2024 | Expand-Map-Reduce: A Elementary Framework for Understanding Quantum Algorithms. | Videet Acharya, Nakul Bhachawat, Kunal Korgaonkar |
| 2024 | A Hands-On Approach to Teaching Parallel and Heterogeneous Computing. | Abubeker Abdurahman, Arihant Singh, Abrar Hossain, Kishwar Ahmed |
| 2024 | Improving Parallel Exhaustive Subgroup Discovery with Early Search Space Pruning. | Jyoti, Ashutosh Litoriya, Sriram Kailasam |
| 2023 | Efficient GPU Implementation of Automatic Differentiation for Computational Fluid Dynamics. | Mohammad Zubair, Desh Ranjan, Aaron Walden, Gabriel Nastac, Eric J. Nielsen, Boris Diskin, Marc F. Paterno, Samuel Jung, Joshua Hoke Davis |
| 2023 | Reduce Computational Complexity for Convolutional Layers by Skipping Zeros. | Zhiyi Zhang, Pengfei Zhang, Zhuopin Xu, Qi Wang |
| 2023 | MiCRO: Near-Zero Cost Gradient Sparsification for Scaling and Accelerating Distributed DNN Training. | Daegun Yoon, Sangyoon Oh |
| 2023 | Flover: A Temporal Fusion Framework for Efficient Autoregressive Model Parallel Inference. | Jinghan Yao, Nawras Alnaasan, Tian Chen, Aamir Shafi, Hari Subramoni, Dhabaleswar K. D. K. Panda |
| 2023 | DeltaSPARSE: High-Performance Sparse General Matrix-Matrix Multiplication on Multi-GPU Systems. | Shuai Yang, Changyou Zhang, Ji Ma |
| 2023 | A 118 GOPS/mm | Mengtian Yang, Yipeng Wang, Jaydeep P. Kulkarni |