| 2025 | COF: Cycle and transmission co-mapping framework for CNN mapping in PIM architecture. | Xianfa Zhou, Tun Li, Yuhuan Xia, Ruiyu Zhang |
| 2025 | LLaMCAT: Optimizing Large Language Model Inference with Cache Arbitration and Throttling. | Zhongchun Zhou, Chengtao Lai, Wei Zhang |
| 2025 | ADAPT: Dynamic Grouping and Cross-Group Aggregation for GC-Efficient Log-Structured Storage in SSD Arrays. | Ruisong Zhou, Peng Wang, Chunhua Li, Ke Zhou, Hui Li |
| 2025 | Cycle-Aware Parallel Optimization for Mitigating ZZ Crosstalk on Quantum Hardware. | Jiayi Zhong, Yuxin Deng |
| 2025 | Efficient Cross-Datacenter Congestion Control with Fast Control Loops. | Baosen Zhao, Jianan Sun, Xu Zhou, Wanghong Yang, Wenji Du, Fukang Chen, Yongmao Ren, Stefan Schmid |
| 2025 | Decision Shuffle: Efficient Pre-scheduling System for Push-based Shuffle in DAG Computing Frameworks. | Shihao Zhang, Chi Zhang, Chentao Wu, Jie Li, Minyi Guo, Hui Li, Liqiang Zhang |
| 2025 | HMGraph: Boosting GNN Training on Hierarchical Memory via Coordinated Cache. | Lizhi Zhang, Menghan Jia, Zhiquan Lai, Qiao Li, Yiming Zhang, Dongsheng Li |
| 2025 | WinRS: Accelerate Winograd Backward-Filter Convolution with Tiny Workspace. | Zhiyi Zhang, Junshi Chen, Jingwei Sun, Pengfei Zhang, Zhuopin Xu, Jun Shi, Qi Wang |
| 2025 | Heterogeneity-aware Task Scheduling based on Personalized Federated Reinforcement Learning. | Xin Yong, Li Yan, Zhuozhao Li |
| 2025 | Cross-Architecture Performance Analysis Using the RAJA Performance Suite. | Dewi Yokelson, Stephanie Brink, Jason Burmark, Michael McKinsey, Befikir Bogale, Ian Lumsden, Michela Taufer, Tom Scogland, Olga Pearce |
| 2025 | SpeedSketch: An Ultra-Fast Sketch Generation and Delta Encoding Framework for Delta Compression. | Fengkui Yang, Yuanzhang Wang, Chunhua Li, Ke Zhou, Hui Li |
| 2025 | PISCES: Push-Pull Hybrid Optimization for Graph Pattern Matching. | Changjie Xu, Ke Meng, Zhiheng Lin, Guangming Tan |
| 2025 | Accelerating Erasure Coding on Persistent Memory via Adaptive Prefetcher Scheduling. | Guanglei Xu, Hai Zhou, Yuchong Hu, Dan Feng, Renzhi Xiao |
| 2025 | Design of Interposer Interconnection Network Based on High-Radix Interposer Routers. | Xue Xiao, Yi Dai, Yanqiang Sun, Jianmin Zhang, Tiejun Li |
| 2025 | Efficient Construction of Large Search Spaces for Auto-Tuning. | Floris-Jan Willemsen, Rob V. van Nieuwpoort, Ben van Werkhoven |
| 2025 | AMPED: Accelerating MTTKRP for Billion-Scale Sparse Tensor Decomposition on Multiple GPUs. | Sasindu Wijeratne, Rajgopal Kannan, Viktor K. Prasanna |
| 2025 | Amber: Towards Fast and Space-Efficient Incremental Checkpointing in Large Language Model Training. | Zhiqiang Wang, Wenzhe Zhu, Zaigui Zhang, Chaomei Yan, Fan Guo, Yongkun Li, Yinlong Xu |
| 2025 | Optimizing Direct Convolutions on High-Performance Multi-Core DSPs. | Pengyu Wang, Xiaotian Chen, Jianbin Fang, Peng Zhang, Yonggang Che, Chun Huang, Jie Ren |
| 2025 | ESC: Effective Submanifold Convolution using Tensor Cores. | Xuezhu Wang, Hailong Yang, Xin You, Yufan Xu, Xiaoyan Liu, Siqi Wang, Kaige Zhang, Mingzhen Li, Zhongzhi Luan, Yi Liu, Depei Qian |
| 2025 | pyGinkgo: A Sparse Linear Algebra Operator Framework for Python. | Keshvi Tuteja, Gregor Olenik, Roman Mishchuk, Yu-Hsiang Tsai, Markus Gtz, Achim Streit, Hartwig Anzt, Charlotte Debus |
| 2025 | Leave No One Behind: Fair and Efficient Tiered Memory Management for Multi-Applications. | Wenda Tang, Yiduo Wang, Yanwen Wang, Jie Wu |
| 2025 | Scaling Distributed Graph Processing to Hundreds of GPUs. | George M. Slota, Michael Mandulak |
| 2025 | Optimizing Incomplete Cholesky Factorization on MIMD Many-core Architecture. | Yongzhen Shi, Qinglin Wang, Jie Liu, Lian Wang, Zhiyan Liu, Bingwei Wang, Feiming Liu, Xiangdong Pei |
| 2025 | TAPAS: Fast and Automatic Derivation of Tensor Parallel Strategies for Large Neural Networks. | Ziji Shi, Le Jiang, Ang Wang, Jie Zhang, Chencan Wu, Yong Li, Xiaokui Xiao, Wei Lin, Jialin Li |
| 2025 | HeatList: The Case for Retrofitting In-memory Range Index with Hotspot Awareness. | Junru Shen, Miao Cai, Kangyue Gao, Baoliu Ye, Guo Cheng |