| 2023 | SC | Task-Based Polar Decomposition Using SLATE on Massively Parallel Systems with Hardware Accelerators. | Dalal Sukkari, Mark Gates, Mohammed A. Al Farhan, Hartwig Anzt, Jack J. Dongarra |
| 2022 | SC | Threshold Pivoting for Dense LU Factorization. | Neil Lindquist, Mark Gates, Piotr Luszczek, Jack J. Dongarra |
| 2021 | ICS | Task-graph scheduling extensions for efficient synchronization and communication. | Seonmyeong Bak, Oscar R. Hernandez, Mark Gates, Piotr Luszczek, Vivek Sarkar |
| 2019 | EuroPar | Linear Systems Solvers for Distributed-Memory Machines with GPU Accelerators. | Jakub Kurzak, Mark Gates, Ali Charara, Asim YarKhan, Ichitaro Yamazaki, Jack J. Dongarra |
| 2019 | ICPP | Massively Parallel Automated Software Tuning. | Jakub Kurzak, Yaohung M. Tsai, Mark Gates, Ahmad Abdelfattah, Jack J. Dongarra |
| 2019 | ICS | Least squares solvers for distributed-memory machines with GPU accelerators. | Jakub Kurzak, Mark Gates, Ali Charara, Asim YarKhan, Jack J. Dongarra |
| 2019 | SC | SLATE: design of a modern distributed and accelerated linear algebra library. | Mark Gates, Jakub Kurzak, Ali Charara, Asim YarKhan, Jack J. Dongarra |
| 2014 | SC | Performance and portability with OpenCL for throughput-oriented HPC workloads across accelerators, coprocessors, and multicore processors. | Chongxiao Cao, Mark Gates, Azzam Haidar, Piotr Luszczek, Stanimire Tomov, Ichitaro Yamazaki, Jack J. Dongarra |
| 2013 | ICS | Toward a scalable multi-GPU eigensolver via compute-intensive kernels and efficient communication. | Azzam Haidar, Mark Gates, Stanimire Tomov, Jack J. Dongarra |
| 2013 | PPAM | Portable HPC Programming on Intel Many-Integrated-Core Hardware with MAGMA Port to Xeon Phi. | Jack J. Dongarra, Mark Gates, Azzam Haidar, Yulu Jia, Khairul Kabir, Piotr Luszczek, Stanimire Tomov |