| 2021 | DistMILE: A Distributed Multi-Level Framework for Scalable Graph Embedding. | Yuntian He, Saket Gurukar, Pouya Kousha, Hari Subramoni, Dhabaleswar K. Panda, Srinivasan Parthasarathy |
| 2021 | A Fused Inference Design for Pattern-Based Sparse CNN on Edge Devices. | Jia Guo, Radu Teodorescu, Gagan Agrawal |
| 2021 | DEISA: Dask-Enabled In Situ Analytics. | Amal Gueroudji, Julien Bigot, Bruno Raffin |
| 2021 | PPBT: A High Performance Parallel Search Tree. | Jiawen Guan, Rui Fan |
| 2021 | Anti-Section Transitive Closure. | Oded Green, Zhihui Du, Sanyamee Patel, Zehui Xie, Hang Liu, David A. Bader |
| 2021 | 3rd Workshop on Education for High Performance Computing (EduHiPC - 2021). | Sheikh K. Ghafoor, Sushil K. Prasad |
| 2021 | FaaSter: Accelerated Functions-as-a-Service with Heterogeneous GPUs. | Anshuj Garg, Purushottam Kulkarni, Umesh Bellur, Sriram Yenamandra |
| 2021 | Cloud-Based Urgent Computing for Forest Fire Spread Prediction under Data Uncertainties. | Edigley Fraga, Ana Corts, Toms Margalef, Porfidio Hernndez |
| 2021 | Load-balancing Parallel I/O of Compressed Hierarchical Layouts. | Ke Fan, Duong Hoang, Steve Petruzza, Thomas Gilray, Valerio Pascucci, Sidharth Kumar |
| 2021 | Broad Awareness of Unseen Work on a Concurrency-Based Assignment. | Prasun Dewan, Samuel D. George, Bowen Gu, Zhizhou Liu, Hao Wang, Andrew Wortas |
| 2021 | Efficient Parallel Algorithms for Computing Percolation Centrality. | Athreya Chandramouli, Sayantan Jana, Kishore Kothapalli |
| 2021 | iPUG for Multiple Graphcore IPUs: Optimizing Performance and Scalability of Parallel Breadth-First Search. | Luk Burchard, Xing Cai, Johannes Langguth |
| 2021 | Improving Efficiency and Performance Through Faster Scheduling Mechanisms. | Adam Belay |
| 2021 | An In-Depth I/O Pattern Analysis in HPC Systems. | Jiwoo Bang, Chungyong Kim, Kesheng Wu, Alex Sim, Suren Byna, Hanul Sung, Hyeonsang Eom |
| 2021 | Empirical Analysis of Architectural Primitives for NVRAM Consistency. | K. P. Arun, Debadatta Mishra, Biswabandan Panda |
| 2021 | Column-Segmented Sparse Matrix-Matrix Multiplication on Multicore CPUs. | Xiaojing An, mit V. atalyrek |
| 2021 | Performance of Local Push Algorithms for Personalized PageRank on Multi-core Platforms. | Madhav Aggarwal, Bingyi Zhang, Viktor K. Prasanna |
| 2021 | Teaching Parallel and Distributed Computing Concepts Using OpenMPI and Java. | Joel C. Adams |
| 2021 | Parallel Actors and Learners: A Framework for Generating Scalable RL Implementations. | Chi Zhang, Sanmukh Rao Kuppannagari, Viktor K. Prasanna |
| 2021 | Towards Architecture-aware Hierarchical Communication Trees on Modern HPC Systems. | Bharath Ramesh, Jahanzeb Maqbool Hashmi, Shulei Xu, Aamir Shafi, Seyedeh Mahdieh Ghazimirsaeed, Mohammadreza Bayatpour, Hari Subramoni, Dhabaleswar K. Panda |
| 2020 | SparsePipe: Parallel Deep Learning for 3D Point Clouds. | Keke Zhai, Pan He, Tania Banerjee, Anand Rangarajan, Sanjay Ranka |
| 2020 | Batched Small Tensor-Matrix Multiplications on GPUs. | Keke Zhai, Tania Banerjee, Adeesha Wijayasiri, Sanjay Ranka |
| 2020 | Computing and Data Challenges in Climate Change. | Katherine A. Yelick |
| 2020 | SimGQ: Simultaneously Evaluating Iterative Graph Queries. | Chengshuo Xu, Abbas Mazloumi, Xiaolin Jiang, Rajiv Gupta |
| 2020 | AMCilk: A Framework for Multiprogrammed Parallel Workloads. | Zhe Wang, Chen Xu, Kunal Agrawal, Jing Li |