| 2025 | Carbon-Aware Workflow Scheduling with Fixed Mapping and Deadline Constraint. | Dominik Schweisgut, Anne Benoit, Yves Robert, Henning Meyerhenke |
| 2025 | Performant Unified GPU Kernels for Portable Singular Value Computation Across Hardware and Precision. | Evelyne Ringoot, Rabab Alomairy, Valentin Churavy, Alan Edelman |
| 2025 | Lias: Leveraging Performance Counters for Interference Quantification and Mitigation in Multi-processor Systems. | Yangfan Qiao, Zhuozhao Li |
| 2025 | Multiprocessor Scheduling with Memory Constraints: Fundamental Properties and Finding Optimal Solutions. | Pl Andrs Papp, Toni Bhnlein, Albert-Jan Nicholas Yzelman |
| 2025 | Optimizing NumPy with SVE Acceleration on ARM Architectures. | Kuldeep Pal, Aniket P. Garade, Deepika H. V, Haribabu P, S. A. Kumar, S. D. Sudarsan |
| 2025 | It Takes Two: Accelerating Accurate Federated Learning through Pipelined Intra-Batch Data Sampling and Training. | Chenghao Nu, Zhe Zhang, Ye Li, Yanchao Zhao |
| 2025 | Efficient Parallel Algorithms for Dynamic Percolation Centrality. | Prajjwal Nijhara, Lokesh Venkatachalam, Agam Harpreet Singh, Athreya Chandramouli, Sayantan Jana, Kishore Kothapalli, Dip Sankar Banerjee |
| 2025 | IRIS-MASH: Efficient Multi-device Asynchronous Multi-Stream Heterogeneous Computing. | Narasinga Rao Miniskar, Aaron R. Young, Mohammad Alaul Haque Monil, Kazi Asifuzzaman, Beau Johnston, Keita Teranishi, Jeffrey S. Vetter |
| 2025 | Power Capping of GPU Servers for Machine Learning Inference Optimization. | Yuan Ma, Srinivasan Subramaniyan, Xiaorui Wang |
| 2025 | Adaptive Job Scheduling in Quantum Clouds Using Reinforcement Learning. | Waylon Luo, Jiapeng Zhao, Tong Zhan, Qiang Guan |
| 2025 | Scheduling based on Block Features for Concurrent Inference with Unseen DNN Models on GPU. | Diaohan Luo, Zhen Tang, Heran Gao, Yuewen Wu, Heng Wu, Xi Han, Wenbo Zhang |
| 2025 | Bridging Cache-Friendliness and Concurrency: A Locality-Optimized In-Memory B-Skiplist. | Yicong Luo, Senhe Hao, Brian Wheatman, Prashant Pandey, Helen Xu |
| 2025 | Heterogeneity-aware Federated Edge Learning via UAV Sampling and D2D Communications. | Yanfeng Lu, Tao Wu, Chao Chang, Hongjun Wang, Mingxing Ke, Jian Wang |
| 2025 | Automated FPGA Accelerator Generation Framework for Transformers with Dataflow Optimization. | Wenqi Lou, Yunji Qin, Zihao Wang, Chao Wang, Lei Gong, Xuehai Zhou |
| 2025 | Accelerating Multi-Output GBDTs with GPUs. | Hanfeng Liu, Xuemei Peng, Zeyi Wen |
| 2025 | FLEX: Leveraging FPGA-CPU Synergy for Mixed-Cell-Height Legalization Acceleration. | Xingyu Liu, Jiawei Liang, Linfeng Du, Yipu Zhang, Chaofang Ma, Hanwei Fan, Jiang Xu, Wei Zhang |
| 2025 | PTWalker: Cache-Efficient Random Walks via Alternating Dual-Subgraph Walker Updating. | Shuai Lin, Rui Wang, Zaigui Zhang, Long Deng, Wenzhe Zhu, Yongkun Li, Yinlong Xu |
| 2025 | Accelerating an Electromagnetic Simulation via Memory-Constrained Task-Based Load Balancing. | Jonathan Lifflander, Nicole Slattengren, Philippe P. Pbay, Pierre L. Pebay, Caleb Schilly, Robert A. Pfeiffer, Joseph D. Kotulski |
| 2025 | FedWCM: Unleashing the Potential of Momentum-based Federated Learning in Long-Tailed Scenarios. | Tianle Li, Yongzhi Huang, Linshan Jiang, Qipeng Xie, Chang Liu, Wenfeng Du, Lu Wang, Kaishun Wu |
| 2025 | OVERT: Orchestrating Vector-Scalar Execution for Efficient SpMV on Modern CPUs. | Kelun Lei, Hailong Yang, Kaige Zhang, Shaokang Du, Marc Casas, Yufan Xu, Zhongzhi Luan, Yi Liu, Depei Qian |
| 2025 | ParaCOSM: A Parallel Framework for Continuous Subgraph Matching. | Haibin Lai, Sicheng Zhou, Site Fan, Zhuozhao Li |
| 2025 | SmartBlock: Adaptive Block Floating Point Quantization for Efficient DNN Acceleration. | Xin Ju, Jingkui Yang, Mei Wen, Jun He, Jing Feng, Minjin Tang, Zhaoyun Chen, Yang Shi |
| 2025 | Solving Extended Flexible Job Shop Scheduling Problems with Deep Reinforcement Learning. | Haonan Jiang, Yusen Li, Xiaoguang Liu, Gang Wang, Xuebo Zhang |
| 2025 | P3P-Fed: Peer-to-Peer Personalized Federated Learning with DHT-based Local Clustering. | Sooho Jang, Ahyeon Lim, Yuchan Lee, Sookwang Lee, Jaehwan Lee |
| 2025 | A Fast Sparse Triangular Solve for Structured-grid Problems on Heterogeneous Processors. | Zhengding Hu, Yi Zong, Jingwei Sun, Wei Xue, Guangzhong Sun |