| 2021 | CuART - a CUDA-based, scalable Radix-Tree lookup and update engine. | Martin Koppehel, Tobias Groth, Sven Groppe, Thilo Pionteck |
| 2021 | MetaCache-GPU: Ultra-Fast Metagenomic Classification. | Robin Kobus, Andr Mller, Daniel Jnger, Christian Hundt, Bertil Schmidt |
| 2021 | Tridiagonal GPU Solver with Scaled Partial Pivoting at Maximum Bandwidth. | Christoph Klein, Robert Strzodka |
| 2021 | ROBOTune: High-Dimensional Configuration Tuning for Cluster-Based Data Analytics. | Md. Muhib Khan, Weikuan Yu |
| 2021 | Accelerating DBSCAN Algorithm with AI Chips for Large Datasets. | Zhuoran Ji, Cho-Li Wang |
| 2021 | Matryoshka: A Coalesced Delta Sequence Prefetcher. | Shizhi Jiang, Yiwei Ci, Qiusong Yang, Mingshu Li |
| 2021 | AMPS-Inf: Automatic Model Partitioning for Serverless Inference with Cost Efficiency. | Jananie Jarachanthan, Li Chen, Fei Xu, Bo Li |
| 2021 | Parallel Multi-split Extendible Hashing for Persistent Memory. | Jing Hu, Jianxi Chen, Yifeng Zhu, Qing Yang, Zhouxuan Peng, Ya Yu |
| 2021 | A Novel Multi-CPU/GPU Collaborative Computing Framework for SGD-based Matrix Factorization. | Yizhi Huang, Yanlong Yin, Yan Liu, Shuibing He, Yang Bai, Renfa Li |
| 2021 | Wave-PIM: Accelerating Wave Simulation Using Processing-in-Memory. | Bagus Hanindhito, Ruihao Li, Dimitrios Gourounas, Arash Fathi, Karan Govil, Dimitar Trenev, Andreas Gerstlauer, Lizy Kurian John |
| 2021 | ComputeCOVID19+: Accelerating COVID-19 Diagnosis and Monitoring via High-Performance Deep Learning on CT Images. | Garvit Goel, Atharva Gondhalekar, Jingyuan Qi, Zhicheng Zhang, Guohua Cao, Wu-Chun Feng |
| 2021 | FIFL: A Fair Incentive Mechanism for Federated Learning. | Liang Gao, Li Li, Yingwen Chen, Wenli Zheng, Chengzhong Xu, Ming Xu |
| 2021 | Automatic Generation of High-Performance Inference Kernels for Graph Neural Networks on Multi-Core Systems. | Qiang Fu, H. Howie Huang |
| 2021 | Accelerating Sequence-to-Graph Alignment on Heterogeneous Processors. | Zonghao Feng, Qiong Luo |
| 2021 | Regu2D: Accelerating Vectorization of SpMV on Intel Processors through 2D-partitioning and Regular Arrangement. | Xiang Fei, Youhui Zhang |
| 2021 | CNN+LSTM Accelerated Turbulent Flow Simulation with Link-Wise Artificial Compressibility Method. | Sijiang Fan, Jiawei Fei, Xiaowei Guo, Canqun Yang, Alistair Revell |
| 2021 | Exploiting in-Hub Temporal Locality in SpMV-based Graph Processing. | Mohsen Koohi Esfahani, Peter Kilpatrick, Hans Vandierendonck |
| 2021 | Scaling Generalized N-Body Problems, A Case Study from Genomics. | Marquita Ellis, Aydin Bulu, Katherine A. Yelick |
| 2021 | GVT-Guided Demand-Driven Scheduling in Parallel Discrete Event Simulation. | Ali Eker, David Timmerman, Barry Williams, Kenneth Chiu, Dmitry Ponomarev |
| 2021 | Fast and Consistent Remote Direct Access to Non-volatile Memory. | Jingwen Du, Fang Wang, Dan Feng, Weiguang Li, Fan Li |
| 2021 | Joint Optimization of DNN Partition and Scheduling for Mobile Cloud Computing. | Yubin Duan, Jie Wu |
| 2021 | A Graph-Assisted Out-of-Place Update Scheme for Erasure Coded Storage Systems. | Haiwei Deng, Ranhao Jia, Chentao Wu |
| 2021 | BGPQ: A Heap-Based Priority Queue Design for GPUs. | Yan-Hao Chen, Fei Hua, Yuwei Jin, Eddy Z. Zhang |
| 2021 | Coupling Right-Provisioned Cold Storage Data Centers with Deduplication. | Liangfeng Cheng, Yuchong Hu, Zhaokang Ke, Zhongjie Wu |
| 2021 | HiPa: Hierarchical Partitioning for Fast PageRank on NUMA Multicore Systems. | YuAng Chen, Yeh-Ching Chung |