| 2025 | High-performance Visual Semantics Compression for AI-Driven Science. | Boyuan Zhang, Luanzheng Guo, Jiannan Tian, Jinyang Liu, Daoce Wang, Fanjiang Ye, Chengming Zhang, Jan Strube, Nathan R. Tallent, Dingwen Tao |
| 2024 | POSTER: RELAX: Durable Data Structures with Swift Recovery. | Almog Zur, Nachshon Cohen, Michal Friedman, Erez Petrank |
| 2024 | POSTER: StructMG: A Fast and Scalable Structured Multigrid. | Yi Zong, Xinliang Wang, Haopeng Huang, Chensong Zhang, Xiaowen Xu, Jian Sun, Bowen Yan, Qin Wang, Sicong Li, Zhaohui Ding, Wei Xue |
| 2024 | POSTER: LLM-PQ: Serving LLM on Heterogeneous Clusters with Phase-Aware Partition and Adaptive Quantization. | Juntao Zhao, Borui Wan, Chuan Wu, Yanghua Peng, Haibin Lin |
| 2024 | A Holistic Approach to Automatic Mixed-Precision Code Generation and Tuning for Affine Programs. | Jinchen Xu, Guanghui Song, Bei Zhou, Fei Li, Jiangwei Hao, Jie Zhao |
| 2024 | Extreme-scale Direct Numerical Simulation of Incompressible Turbulence on the Heterogeneous Many-core System. | Jiabin Xie, Guangnan Feng, Han Huang, Junxuan Feng, Zhiguang Chen, Yutong Lu |
| 2024 | Zero-Overhead Parallel Scans for Multi-Core CPUs. | Ivo Gabe de Wolff, David P. van Balen, Gabriele K. Keller, Trevor L. McDonell |
| 2024 | CPMA: An Efficient Batch-Parallel Compressed Set Without Pointers. | Brian Wheatman, Randal C. Burns, Aydin Bulu, Helen Xu |
| 2024 | Sparsity in Deep Neural Nets (Keynote). | Nir Shavit |
| 2024 | Parallel Pattern Language Code Generation. | Adrian Schmitz, Julian Miller, Semih Burak, Matthias S. Mller |
| 2024 | Scaling Up Transactions with Slower Clocks. | Pedro Ramalhete, Andreia Correia |
| 2024 | Towards Scalable Unstructured Mesh Computations on Shared Memory Many-Cores. | Haozhong Qiu, Chuanfu Xu, Jianbin Fang, Liang Deng, Jian Zhang, Qingsong Wang, Yue Ding, Zhe Dai, Yonggang Che, Shizhao Chen, Jie Liu |
| 2024 | Pure: Evolving Message Passing To Better Leverage Shared Memory Within Nodes. | James Psota, Armando Solar-Lezama |
| 2024 | INFINEL: An efficient GPU-based processing method for unpredictable large output graph queries. | Sungwoo Park, Seyeon Oh, Min-Soo Kim |
| 2024 | AGAThA: Fast and Efficient GPU Acceleration of Guided Sequence Alignment for Long Read Mapping. | Seongyeon Park, Junguk Hong, Jaeyong Song, Hajin Kim, Youngsok Kim, Jinho Lee |
| 2024 | Locks as a Resource: Fairly Scheduling Lock Occupation with CFL. | Jonggyu Park, Young Ik Eom |
| 2024 | A Row Decomposition-based Approach for Sparse Matrix Multiplication on GPUs. | Meng Pang, Xiang Fei, Peng Qu, Youhui Zhang, Zhaolin Li |
| 2024 | Language-Agnostic Static Deadlock Detection for Futures. | Stefan K. Muller |
| 2024 | POSTER: OCToPus: Semantic-aware Concurrency Control for Blockchain Transactions. | dePaul Miller, Henry F. Korth, Roberto Palmieri |
| 2024 | MUPPET: Optimizing Performance in OpenMP via Mutation Testing. | Dolores Miao, Ignacio Laguna, Giorgis Georgakoudis, Konstantinos Parasyris, Cindy Rubio-Gonzlez |
| 2024 | Gallatin: A General-Purpose GPU Memory Manager. | Hunter McCoy, Prashant Pandey |
| 2024 | ParlayANN: Scalable and Deterministic Parallel Graph-Based Approximate Nearest Neighbor Search Algorithms. | Magdalen Dobson Manohar, Zheqi Shen, Guy E. Blelloch, Laxman Dhulipala, Yan Gu, Harsha Vardhan Simhadri, Yihan Sun |
| 2024 | POSTER: FineCo: Fine-grained Heterogeneous Resource Management for Concurrent DNN Inferences. | Lixian Ma, Haoruo Chen, En Shao, Leping Wang, Quan Chen, Guangming Tan |
| 2024 | Acceleration of the Pre-processing Stage of the MVS Workflow using Graphics Processors. | Roberto Daz-Cano Lozano, Francesc Folch, Pedro Alonso-Jord, Enrique S. Quintana-Ort |
| 2024 | Automatic Static Analysis-Guided Optimization of CUDA Kernels. | Mark Lou, Stefan K. Muller |