| 2024 | MPR: An MPI Framework for Distributed Self-adaptive Stream Processing. | Jnior Lff, Dalvan Griebler, Luiz Gustavo Fernandes, Walter Binder |
| 2024 | Efficient Deployment and Fine-Tuning of Transformer-Based Models on the Device-Edge. | Hongfeng Li, Geming Xia, Yuze Zhang, Zhiping Cai, Hongcheng Li, Chaodong Yu |
| 2024 | Automated Data Management and Learning-Based Scheduling for Ray-Based Hybrid HPC-Cloud Systems. | Tingkai Liu, Huili Tao, Yicheng Lu, Zhongbo Zhu, Marquita Ellis, Sara Kokkila Schumacher, Volodymyr V. Kindratenko |
| 2024 | Pipe-AGCM: A Fine-Grain Pipelining Scheme for Optimizing the Parallel Atmospheric General Circulation Model. | Dazheng Liu, Xiaoli Ren, Jianping Wu, Wenjuan Liu, Juan Zhao, Shaoliang Peng |
| 2024 | Accelerating Scientific Computing Kernels by Fusing the Polyhedral and Tensor Compilers. | Qingzhi Liu, Changbo Chen, Hanwen Dai |
| 2024 | TaroRTL: Accelerating RTL Simulation Using Coroutine-Based Heterogeneous Task Graph Scheduling. | Dian-Lun Lin, mit Y. Ogras, Joshua San Miguel, Tsung-Wei Huang |
| 2024 | Boolean Matrix Multiplication for Highly Clustered Data on the Congested Clique. | Andrzej Lingas |
| 2024 | Context-Aware Runtime Type Prediction for Heterogeneous Microservices. | Yibing Lin, Binbin Feng, Zhijun Ding |
| 2024 | Applying Machine Learning for Social Networks Agent-Based Models. | Haoyuan Li, Lidia Conde Matos, Eduardo Csar Galobardes, Anna Sikora |
| 2024 | Improving Generalization and Personalization in Long-Tailed Federated Learning via Classifier Retraining. | Yuhang Li, Tong Liu, Wenfeng Shen, Yangguang Cui, Weijia Lu |
| 2024 | Performance Implications of SEV Virtual Machine Live Migration. | Jian-Lin Li, Shih-Wei Li |
| 2024 | Efficient RNIC Cache Side-Channel Attack Detection Through DPU-Driven Architecture. | Yunkun Liao, Jingya Wu, Wenyan Lu, Xiaowei Li, Guihai Yan |
| 2024 | Athena: Add More Intelligence to RMT-Based Network Data Plane with Low-Bit Quantization. | Yunkun Liao, Hanyue Lin, Jingya Wu, Wenyan Lu, Huawei Li, Xiaowei Li, Guihai Yan |
| 2024 | Accelerated Block-Sparsity-Aware Matrix Reordering for Leveraging Tensor Cores in Sparse Matrix-Multivector Multiplication. | Eunji Lee, Yoonsang Han, Gordon Euhyun Moon |
| 2024 | Predicting GPU Kernel's Performance on Upcoming Architectures. | Lucas Van Lanker, Hugo Taboada, Elisabeth Brunet, Franois Trahay |
| 2024 | Byzantine-Tolerant Privacy-Preserving Atomic Register. | Vincent Kowalski, Achour Mostfaoui, Matthieu Perrin, Sinchan Sengupta |
| 2024 | Hybrid Quantum Computing: The Use Case of Shor's Algorithm. | Ocane Koska, Arnaud Gazda, Maxime Remaud |
| 2024 | Efficient Coupling Streaming AI and Ensemble Simulations on HPC Clusters. | Jiazhi Jiang, Hongbin Zhang, Deyin Liu, Jiangsu Du, Xiaojiao Yao, Jinhui Wei, Pin Chen, Dan Huang, Yutong Lu |
| 2024 | AdapCK: Optimizing I/O for Checkpointing on Large-Scale High Performance Computing Systems. | Jie Jia, Yi Liu, Yanke Liu, Yifan Chen, Fang Lin |
| 2024 | $$ : A Quantum Emulation Workbench for Benchmark Construction and Application Development. | Elise Jennings, Martin Rfenacht, Stefan Kister |
| 2024 | Parallel Efficiency-Aware Standard MPI-Based Malleability. | Sergio Iserte, Vctor Lpez, Marta Garcia-Gasulla, Antonio J. Pea |
| 2024 | Distributed Simulation for Digital Twins of Large-Scale Real-World DiffServ-Based Networks. | Zhuoyao Huang, Nan Zhang, Jingran Shen, Georgios Diamantopoulos, Zhengchang Hua, Nikos Tziritas, Georgios Theodoropoulos |
| 2024 | Lessons Learned and Scalability Achieved When Porting Uintah to DOE Exascale Systems. | John K. Holmen, Marta Garca, Allen Sanderson, Abhishek Bagusetty, Martin Berzins |
| 2024 | A Practical Survey on Static Task Scheduling Optimization Approaches for Heterogeneous Architectures. | Jonas Hollmann, Matthias Lders, Oliver Jakob Arndt, Ioannis Kyriakopoulos, Holger Blume |
| 2024 | PEANUTS: A Persistent Memory-Based Network Unilateral Transfer System for Enhanced MPI-IO Data Transfer. | Kohei Hiraga, Osamu Tatebe |