| 2021 | Scalable All-pairs Shortest Paths for Huge Graphs on Multi-GPU Clusters. | Piyush Sao, Hao Lu, Ramakrishnan Kannan, Vijay Thakkar, Richard W. Vuduc, Thomas E. Potok |
| 2021 | Apollo: : An ML-assisted Real-Time Storage Resource Observer. | Neeraj Rajesh, Hariharan Devarajan, Jaime Cernuda Garcia, Keith Bateman, Luke Logan, Jie Ye, Anthony Kougkas, Xian-He Sun |
| 2021 | TEMPI: An Interposed MPI Library with a Canonical Representation of CUDA-aware Datatypes. | Carl Pearson, Kun Wu, I-Hsin Chung, Jinjun Xiong, Wen-Mei Hwu |
| 2021 | Motivating High Performance Serverless Workloads. | Hai Duc Nguyen, Zhifei Yang, Andrew A. Chien |
| 2021 | Filling the Gap between Scientific Research on Artificial Intelligence and Industry 4.0 Need. | Daniele Mazzei |
| 2021 | Programmable Per-Packet Network Telemetry: From Wire to Kafka at Scale. | Zhang Liu, Bruce Mah, Yatish Kumar, Chin Guok, Richard Cziva |
| 2021 | MPI-CorrBench: Towards an MPI Correctness Benchmark Suite. | Jan-Patrick Lehr, Tim Jammer, Christian H. Bischof |
| 2021 | GPU-based Classification for Wireless Intrusion Detection. | Alina Lazar, Alex Sim, Kesheng Wu |
| 2021 | Cache-aware Sparse Patterns for the Factorized Sparse Approximate Inverse Preconditioner. | Sergi Laut, Ricard Borrell, Marc Casas |
| 2021 | Distributed Parallel Analysis Engine for High Energy Physics Using AWS Lambda. | Jacek Kusnierz, Maciej Malawski, Vincenzo Eduardo Padulano, Enric Tejedor Saavedra, Pedro Alonso-Jord |
| 2021 | Inter-operability and Orchestration in Heterogeneous Cloud/Edge Resources: The ACCORDION Vision. | Ioannis Korontanis, Konstantinos Tserpes, Maria Pateraki, Lorenzo Blasi, John Violos, Ferran Diego, Eduard Marin, Nicolas Kourtellis, Massimo Coppola, Emanuele Carlini, Zbyszek Ledwon, Przemyslaw Tarkowski, Thomas Loven, Yago Gonzlez Rozas, Mike Kentros, Michael Dodis, Patrizio Dazzi |
| 2021 | Q-adaptive: A Multi-Agent Reinforcement Learning Based Routing on Dragonfly Network. | Yao Kang, Xin Wang, Zhiling Lan |
| 2021 | An Oracle for Guiding Large-Scale Model/Hybrid Parallel Training of Convolutional Neural Networks. | Albert Njoroge Kahira, Truong Thao Nguyen, Leonardo Bautista-Gomez, Ryousei Takano, Rosa M. Badia, Mohamed Wahib |
| 2021 | SnuRHAC: A Runtime for Heterogeneous Accelerator Clusters with CUDA Unified Memory. | Jaehoon Jung, Daeyoung Park, Gangwon Jo, Jungho Park, Jaejin Lee |
| 2021 | Adaptive Configuration of In Situ Lossy Compression for Cosmology Simulations via Fine-Grained Rate-Quality Modeling. | Sian Jin, Jesus Pulido, Pascal Grosset, Jiannan Tian, Dingwen Tao, James P. Ahrens |
| 2021 | Parallel Program Scaling Analysis using Hardware Counters. | Shobhit Jagga, Preeti Malakar |
| 2021 | Towards Exploiting CPU Elasticity via Efficient Thread Oversubscription. | Hang Huang, Jia Rao, Song Wu, Hai Jin, Hong Jiang, Hao Che, Xiaofeng Wu |
| 2021 | Evaluations of Network Performance Enhancement on Cloud-native Network Function. | Yong-Xuan Huang, Jerry Chou |
| 2021 | DLion: Decentralized Distributed Deep Learning in Micro-Clouds. | Rankyung Hong, Abhishek Chandra |
| 2021 | Characterizing Resource Heterogeneity in Edge Devices for Deep Learning Inferences. | Jianwei Hao, Piyush Subedi, In Kee Kim, Lakshmish Ramaswamy |
| 2021 | DStore: A Fast, Tailless, and Quiescent-Free Object Store for PMEM. | Shashank Gugnani, Xiaoyi Lu |
| 2021 | Data Science Workflows for the Cloud/Edge Computing Continuum. | Valerio Grossi, Roberto Trasarti, Patrizio Dazzi |
| 2021 | Computing Challenges for High Energy Physics. | Maria Girone |
| 2021 | AI-Based Container Orchestration for Federated Cloud Environments. | Yodit Gebrealif, Mohammed Mubarkoot, Jrn Altmann, Bernhard Egger |
| 2021 | ARC: An Automated Approach to Resiliency for Lossy Compressed Data via Error Correcting Codes. | Dakota Fulp, Alexandra Poulos, Robert Underwood, Jon C. Calhoun |