Skip to content

Principles and Practice of Parallel Programming

PPoPP

B

CORE rank

CORE rank (raw)

B

Fields of research

Distributed Computing and Systems Software

Papers indexed

1,441

1988–2026

Papers per year

198886 peak2026

PPoPP papers

1,441 records sourced from DBLP. Search titles, filter by year, sort by recency.

YearTitleAuthors
2026ROME: Maximizing GPU Efficiency for All-Pairs Shortest Path via Taming Fine-Grained Irregularities.Weile Luo, Yuhan Chen, Xiangrui Yu, Qiang Wang, Ruibo Fan, Hongyuan Liu, Xiaowen Chu
2026zBuffer: Zero-Copy and Metadata-Free Serialization for Fast RPC with Scatter-Gather Reflection.Xiangyu Liu, Huiba Li, Shun Gai, Youmin Chen, Yiming Zhang
2026COCCL: A Collective Communication Library Supporting Easy Integration and Configuration of Customized Compression for Scalable LLM Training.Xingchen Liu, Haoran Kong, Hairui Zhao, Shengkai Lyu, Zheng Wei, Man Liu, Xingjian Tian, Liyang Zhao, Zhuohan Chen, Fakang Wang, Zizhong Chen, Zhan Wang, Guangming Tan, Dingwen Tao
2026VDHA: Vector-Driven Hash Aggregation for Sparse Matrix-Sparse Vector Multiplication on GPUs.Yuchen Li, Zhe Pan, Peng Qu, Youhui Zhang
2026Laser: Unlocking Layer-Level Scheduling for Efficient Multi-SLO LLM Serving.Jianxiong Liao, Quanxing Dong, Yunkai Liang, Zhi Zhou, Xu Chen
2026TAC: Cache-Based System for Accelerating Billion-Scale GNN Training on Multi-GPU Platform.Zhiqiang Liang, Hongyu Gao, Jue Wang, Fang Liu, Xingguo Shi, Junyu Gu, Peng Di, Sian Li, Lei Tang, Chunbao Zhou, Lian Zhao, Yangang Wang, Xuebin Chi
2026ASM-SpMM: Unleashing the Potential of Arm SME for Sparse Matrix Multiplication Acceleration.Jiazhi Jiang, Xijia Yao, Jiayu Chen, Jinhui Wei, Dan Huang, Yutong Lu
2026Cacheman: A Comprehensive Last-Level Cache Management System for Multi-tenant Clouds.Xiaokang Hu, Yuchao Cao, Naixuan Guan, Yifan Wu, Xishi Qiu, Shengdong Dai, Ben Luo, Sanchuan Cheng, Fudong Qiu, Yibin Shen, Jiesheng Wu
2026ParDiff: Efficiently Parallelizing Reverse-Mode Automatic Differentiation with Direct Indexing.Shuhong Huang, Shizhi Tang, Yuan Wen, Huanqi Cao, Ruibai Tang, Yidong Chen, Jiping Yu, Yang Li, Chao Jiang, Limin Xiao, Jidong Zhai
2026DTMiner: A Data-Centric System for Efficient Temporal Motif Mining.Yinbo Hou, Hao Qi, Ligang He, Jin Zhao, Yu Zhang, Hui Yu, Longlong Lin, Lin Gu, Wenbin Jiang, Xiaofei Liao, Hai Jin
2026Scaling GPU-to-CPU Migration for Efficient Distributed Execution on CPU Clusters.Ruobing Han, Hyesoon Kim
2026CCL-D: A High-Precision Diagnostic System for Slow and Hang Anomalies in Large-Scale Model Training.Yida Gu, Fakang Wang, Jianhao Fu, Zhenhang Sun, Qianyu Zhang, Hairui Zhao, Xingchen Liu, Yang Tian, Wenjing Huang, Zedong Liu, Yifan Chen, Jinwu Yang, Yueyuan Zhou, Qian Zhao, Haoxu Li, Tao Wang, Feng Yu, Zhan Wang, Guangming Tan, Dingwen Tao
2026SPIDER: Unleashing Sparse Tensor Cores for Stencil Computation via Strided Swapping.Qiqi Gu, Chenpeng Wu, Heng Shi, Jianguo Yao
2026Hapax Locks: Scalable Value-Based Mutual Exclusion.Dave Dice, Alex Kogan
2026Accelerating Sparse Transformer Inference on GPU.Wenhao Dai, Haodong Deng, Mengfei Rong, Xinyu Yang, Hongyu Liu, Fangxin Liu, Hailong Yang, Qianwen Cao, Qingxiao Sun
2026Multiverse: Transactional Memory with Dynamic Multiversioning.Gaetano Coccimiglio, Trevor Brown, Srivatsan Ravi
2026High-Throughput Non-uniformly Quantized 3-bit LLM Inference.YuAng Chen, Wenqi Zeng, Jeffrey Xu Yu
2026MetaAttention: A Unified and Performant Attention Framework across Hardware Backends.Feiyang Chen, Yu Cheng, Lei Wang, Yuqing Xia, Ziming Miao, Lingxiao Ma, Fan Yang, Jilong Xue, Zhi Yang, Mao Yang, Xingda Wei, Haibo Chen
2026PANA: A Fine-Grained Runtime-Adaptive Load Balancing for Parallel SpMV on Multicore CPUs.Haodong Bian, Youhui Zhang, Xiang Fei, Jianqiang Huang, Xiaoying Wang
2026Fixing Non-blocking Data Structures for Better Compatibility with Memory Reclamation Schemes.Md Amit Hasan Arovi, Ruslan Nikolaev
2026Binary Compatible Critical Section Delegation.Junyao Zhang, Zhuo Wang, Zhe Zhou
2026Pipelonk: Accelerating End-to-End Zero-Knowledge Proof Generation on GPUs for PLONK-Based Protocols.Zhiyuan Zhang, Yanxin Cai, Wenhao Yin, Xueyu Wu, Yi Wang, Lei Ju, Zhuoran Ji
2026Trojan Horse: Aggregate-and-Batch for Scaling Up Sparse Direct Solvers on GPU Clusters.Yida Li, Siwei Zhang, Yiduo Niu, Yang Du, Qingxiao Sun, Zhou Jin, Weifeng Liu
2026Sharded Elimination and Combining for Highly-Efficient Concurrent Stacks.Ajay Singh, Nikos Metaxakis, Panagiota Fatourou
2026PRISM: An Efficient GPU-Based Lossy Compression Framework for Progressive Data Retrieval with Multi-Level Interpolation.Bing Lu, Zedong Liu, Hairui Zhao, Dejun Luo, Wenjing Huang, Yida Gu, Jinyang Liu, Guangming Tan, Dingwen Tao
2650 of 1,441← PreviousNext →

Comparable venues

Other A*/A conferences filed under the same field of research.