| 2019 | Efficient Data-Parallel Primitives on Heterogeneous Systems. | Zhuohang Lai, Qiong Luo, Xiaolong Xie |
| 2019 | Massively Parallel Automated Software Tuning. | Jakub Kurzak, Yaohung M. Tsai, Mark Gates, Ahmad Abdelfattah, Jack J. Dongarra |
| 2019 | Spatially-aware Parallel I/O for Particle Data. | Sidharth Kumar, Steve Petruzza, Will Usher, Valerio Pascucci |
| 2019 | Performance Models for Data Transfers: A Case Study with Molecular Chemistry Kernels. | Suraj Kumar, Lionel Eyraud-Dubois, Sriram Krishnamoorthy |
| 2019 | The Case for Water-Immersion Computer Boards. | Michihiro Koibuchi, Ikki Fujiwara, Naoya Niwa, Tomohiro Totoki, Shoichi Hirasawa |
| 2019 | Gossip: Efficient Communication Primitives for Multi-GPU Systems. | Robin Kobus, Daniel Jnger, Christian Hundt, Bertil Schmidt |
| 2019 | Compiler-Assisted GPU Thread Throttling for Reduced Cache Contention. | Hyunjun Kim, Sungin Hong, Hyeonsu Lee, Euiseong Seo, Hwansoo Han |
| 2019 | Approximate Code: A Cost-Effective Erasure Coding Framework for Tiered Video Storage in Cloud Systems. | Huayi Jin, Chentao Wu, Xin Xie, Jie Li, Minyi Guo, Hao Lin, Jianfeng Zhang |
| 2019 | TLB: Traffic-aware Load Balancing with Adaptive Granularity in Data Center Networks. | Jinbin Hu, Jiawei Huang, Wenjun Lv, Weihe Li, Jianxin Wang, Tian He |
| 2019 | Automatic Differentiation for Adjoint Stencil Loops. | Jan Hckelheim, Navjot Kukreja, Sri Hari Krishna Narayanan, Fabio Luporini, Gerard Gorman, Paul D. Hovland |
| 2019 | When Power Oversubscription Meets Traffic Flood Attack: Re-Thinking Data Center Peak Load Management. | Xiaofeng Hou, Mingyu Liang, Chao Li, Wenli Zheng, Quan Chen, Minyi Guo |
| 2019 | Unleashing the Scalability Potential of Power-Constrained Data Center in the Microservice Era. | Xiaofeng Hou, Jiacheng Liu, Chao Li, Minyi Guo |
| 2019 | Modeling the Performance of Atomic Primitives on Modern Architectures. | Fazeleh Sadat Hoseini, Aras Atalar, Philippas Tsigas |
| 2019 | Machine Learning for Fine-Grained Hardware Prefetcher Control. | Jason Hiebel, Laura E. Brown, Zhenlin Wang |
| 2019 | Distributed Join Algorithms on Multi-CPU Clusters with GPUDirect RDMA. | Chengxin Guo, Hong Chen, Feng Zhang, Cuiping Li |
| 2019 | On Max-min Fair Resource Allocation for Distributed Job Execution. | Yitong Guan, Chuanyou Li, Xueyan Tang |
| 2019 | On Integration of Appends and Merges in Log-Structured Merge Trees. | Caixin Gong, Shuibing He, Yili Gong, Yingchun Lei |
| 2019 | LFOC: A Lightweight Fairness-Oriented Cache Clustering Policy for Commodity Multicores. | Adrian Garcia-Garcia, Juan Carlos Saez, Fernando Castro, Manuel Prieto-Matas |
| 2019 | DeepHash: An End-to-End Learning Approach for Metadata Management in Distributed File Systems. | Yuanning Gao, Xiaofeng Gao, Guihai Chen |
| 2019 | swATOP: Automatically Optimizing Deep Learning Operators on SW26010 Many-Core Processor. | Wei Gao, Jiarui Fang, Wenlai Zhao, Jinzhe Yang, Long Wang, Lin Gan, Haohuan Fu, Guangwen Yang |
| 2019 | Speculative Scheduling for Stochastic HPC Applications. | Ana Gainaru, Guillaume Pallez, Hongyang Sun, Padma Raghavan |
| 2019 | Accelerating Long Read Alignment on Three Processors. | Zonghao Feng, Shuang Qiu, Lipeng Wang, Qiong Luo |
| 2019 | Predictable GPUs Frequency Scaling for Energy and Performance. | Kaijie Fan, Biagio Cosenza, Ben H. H. Juurlink |
| 2019 | diBELLA: Distributed Long Read to Long Read Alignment. | Marquita Ellis, Giulia Guidi, Aydin Bulu, Leonid Oliker, Katherine A. Yelick |
| 2019 | AVR: Reducing Memory Traffic with Approximate Value Reconstruction. | Albin Eldstl-Damlin, Pedro Trancoso, Ioannis Sourdis |