Zhen Zheng
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
23
Venues
13
Active years
2006–2026
Best venue rank
A*
Where they publish
Papers
23 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | RoBSA: RoPE-based Blockwise Sparse Multi-head Latent Attention. | Xinyu Shi, Kairong Luo, Zhen Zheng, Wenguang Chen |
| 2025 | EuroSys | Improving GPU Sharing Performance through Adaptive Bubbleless Spatial-Temporal Sharing. | Shulai Zhang, Quan Chen, Weihao Cui, Han Zhao, Chunyu Xue, Zhen Zheng, Wei Lin, Minyi Guo |
| 2025 | USENIX | PluS: Highly Efficient and Expandable ML Compiler with Pluggable Graph Schedules. | Ruofan Wu, Zhen Zheng, Feng Zhang, Chuanjie Liu, Zaifeng Pan, Jidong Zhai, Xiaoyong Du |
| 2024 | EuroSys | WiseGraph: Optimizing GNN with Joint Workload Partition of Graph and Operations. | Kezhao Huang, Jidong Zhai, Liyan Zheng, Haojie Wang, Yuyang Jin, Qihao Zhang, Runqing Zhang, Zhen Zheng, Youngmin Yi, Xipeng Shen |
| 2024 | OSDI | MonoNN: Enabling a New Monolithic Optimization Space for Neural Network Inference Tasks on Modern GPU-Centric Architectures. | Donglin Zhuang, Zhen Zheng, Haojun Xia, Xiafei Qiu, Junjie Bai, Wei Lin, Shuaiwen Leon Song |
| 2024 | SC | RecFlex: Enabling Feature Heterogeneity-Aware Optimization for Deep Recommendation Models with Flexible Schedules. | Zaifeng Pan, Zhen Zheng, Feng Zhang, Bing Xie, Ruofan Wu, Shaden Smith, Chuanjie Liu, Olatunji Ruwase, Xiaoyong Du, Yufei Ding |
| 2024 | USENIX | Quant-LLM: Accelerating the Serving of Large Language Models via FP6-Centric Algorithm-System Co-Design on Modern GPUs. | Haojun Xia, Zhen Zheng, Xiaoxia Wu, Shiyang Chen, Zhewei Yao, Stephen Youn, Arash Bakhtiari, Michael Wyatt, Donglin Zhuang, Zhongzhu Zhou, Olatunji Ruwase, Yuxiong He, Shuaiwen Leon Song |
| 2023 | ASPLOS | RECom: A Compiler Approach to Accelerating Recommendation Model Inference with Massive Embedding Columns. | Zaifeng Pan, Zhen Zheng, Feng Zhang, Ruofan Wu, Hao Liang, Dalin Wang, Xiafei Qiu, Junjie Bai, Wei Lin, Xiaoyong Du |
| 2022 | ASPLOS | AStitch: enabling a new multi-dimensional optimization space for memory-intensive ML training and inference on modern SIMT architectures. | Zhen Zheng, Xuanda Yang, Pengzhan Zhao, Guoping Long, Kai Zhu, Feiwen Zhu, Wenyi Zhao, Xiaoyong Liu, Jun Yang, Jidong Zhai, Shuaiwen Leon Song, Wei Lin |
| 2022 | WWW | DREW: Efficient Winograd CNN Inference with Deep Reuse. | Ruofan Wu, Feng Zhang, Jiawei Guan, Zhen Zheng, Xiaoyong Du, Xipeng Shen |
| 2022 | USENIX | Whale: Efficient Giant Model Training over Heterogeneous GPUs. | Xianyan Jia, Le Jiang, Ang Wang, Wencong Xiao, Ziji Shi, Jie Zhang, Xinyuan Li, Langshi Chen, Yong Li, Zhen Zheng, Xiaoyong Liu, Wei Lin |
| 2021 | EuroSys | DISC: A Dynamic Shape Compiler for Machine Learning Workloads. | Kai Zhu, Wenyi Zhao, Zhen Zheng, Tianyou Guo, Pengzhan Zhao, Junjie Bai, Jun Yang, Xiaoyong Liu, Lansong Diao, Wei Lin |
| 2021 | PPoPP | DAPPLE: a pipelined data parallel approach for training large models. | Shiqing Fan, Yi Rong, Chen Meng, Zongyan Cao, Siyu Wang, Zhen Zheng, Chuan Wu, Guoping Long, Jun Yang, Lixue Xia, Lansong Diao, Xiaoyong Liu, Wei Lin |
| 2021 | PPoPP | Understanding and bridging the gaps in current GNN performance optimizations. | Kezhao Huang, Jidong Zhai, Zhen Zheng, Youngmin Yi, Xipeng Shen |
| 2021 | PPoPP | Exploring deep reuse in winograd CNN inference. | Ruofan Wu, Feng Zhang, Zhen Zheng, Xiaoyong Du, Xipeng Shen |
| 2020 | CoNEXT | Optimizing distributed training deployment in heterogeneous GPU clusters. | Xiaodong Yi, Shiwei Zhang, Ziyue Luo, Guoping Long, Lansong Diao, Chuan Wu, Zhen Zheng, Jun Yang, Wei Lin |
| 2019 | ASPLOS | HiWayLib: A Software Framework for Enabling High Performance Communications for Heterogeneous Pipeline Computations. | Zhen Zheng, Chanyoung Oh, Jidong Zhai, Xipeng Shen, Youngmin Yi, Wenguang Chen |
| 2019 | PPoPP | GOPipe: a granularity-oblivious programming framework for pipelined stencil executions on GPU. | Chanyoung Oh, Zhen Zheng, Xipeng Shen, Jidong Zhai, Youngmin Yi |
| 2017 | MICRO | Versapipe: a versatile programming framework for pipelined computing on GPU. | Zhen Zheng, Chanyoung Oh, Jidong Zhai, Xipeng Shen, Youngmin Yi, Wenguang Chen |
| 2016 | SC | Refactoring and optimizing the community atmosphere model (CAM) on the sunway taihulight supercomputer. | Haohuan Fu, Junfeng Liao, Wei Xue, Lanning Wang, Dexun Chen, Long Gu, Jinxiu Xu, Nan Ding, Xinliang Wang, Conghui He, Shizhen Xu, Yishuang Liang, Jiarui Fang, Yuanchao Xu, Weijie Zheng, Jingheng Xu, Zhen Zheng, Wanjing Wei, Xu Ji, He Zhang, Bingwei Chen, Kaiwei Li, Xiaomeng Huang, Wenguang Chen, Guangwen Yang |
| 2014 | AINA | Holistic Modeling and Performance Evaluation for Converged Network-Cloud Service Provisioning. | Qiang Duan, Zhen Zheng |
| 2012 | ISNN | Hybrid Synchronization of Two Delayed Systems with Uncertain Parameters. | Zhen Zheng, Manchun Tan, Qunfang Wang |
| 2006 | ISDA | Illumination Variation in Images in Independent Component Analysis and Principal Component Analysis Subspaces. | Zhen Zheng, Yan-Xin Zhang |