Skip to content

Ningxin Zheng

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

16

Venues

12

Active years

2018–2026

Best venue rank

A*

Where they publish

Papers

16 indexed papers, newest first.

YearVenueTitleAuthors
2026EuroSysMegaScale-MoE: Large-Scale Communication-Efficient Training of Mixture-of-Experts Models in Production.Chao Jin, Ziheng Jiang, Zhihao Bai, Zheng Zhong, Juncai Liu, Xiang Li, Ningxin Zheng, Xi Wang, Cong Xie, Qi Huang, Wen Heng, Yiyuan Ma, Wenlei Bao, Size Zheng, Xuegui Zheng, Yanghua Peng, Haibin Lin, Xuanzhe Liu, Xin Jin, Xin Liu
2026EuroSysMegaScale-Omni: A Hyper-Scale, Workload-Resilient System for MultiModal LLM Training in Production.Chunyu Xue, Yangrui Chen, Jianyu Jiang, Ningxin Zheng, Junda Feng, Jingji Chen, Shixiong Zhao, Shen Yan, Yi Lin, Lei Shi, Zanbo Wang, Lishu Luo, Faming Wu, Haibin Lin, Yanghua Peng, Xin Liu, Quan Chen
2025ICMLShadowKV: KV Cache in Shadows for High-Throughput Long-Context LLM Inference.Hanshi Sun, Li-Wen Chang, Wenlei Bao, Size Zheng, Ningxin Zheng, Xin Liu, Harry Dong, Yuejie Chi, Beidi Chen
2024OSDILadder: Enabling Efficient Low-Precision Deep Learning Computing through Hardware-aware Tensor Transformation.Lei Wang, Lingxiao Ma, Shijie Cao, Quanlu Zhang, Jilong Xue, Yining Shi, Ningxin Zheng, Ziming Miao, Fan Yang, Ting Cao, Yuqing Yang, Mao Yang
2023CVPREfficientViT: Memory Efficient Vision Transformer with Cascaded Group Attention.Xinyu Liu, Houwen Peng, Ningxin Zheng, Yuqing Yang, Han Hu, Yixuan Yuan
2023ICCVSpaceEvo: Hardware-Friendly Search Space Design for Efficient INT8 Inference.Xudong Wang, Li Lyna Zhang, Jiahang Xu, Quanlu Zhang, Yujing Wang, Yuqing Yang, Ningxin Zheng, Ting Cao, Mao Yang
2023OSDIOptimizing Dynamic Neural Networks with Brainstorm.Weihao Cui, Zhenhua Han, Lingji Ouyang, Yichuan Wang, Ningxin Zheng, Lingxiao Ma, Yuqing Yang, Fan Yang, Jilong Xue, Lili Qiu, Lidong Zhou, Quan Chen, Haisheng Tan, Minyi Guo
2023SOSPPIT: Optimization of Dynamic Sparse Deep Learning Models via Permutation Invariant Transformation.Ningxin Zheng, Huiqiang Jiang, Quanlu Zhang, Zhenhua Han, Lingxiao Ma, Yuqing Yang, Fan Yang, Chengruidong Zhang, Lili Qiu, Mao Yang, Lidong Zhou
2022ASPLOSAstraea: towards QoS-aware and resource-efficient multi-stage GPU services.Wei Zhang, Quan Chen, Kaihua Fu, Ningxin Zheng, Zhiyi Huang, Jingwen Leng, Minyi Guo
2022OSDISparTA: Deep-Learning Model Sparsity via Tensor-with-Sparsity-Attribute.Ningxin Zheng, Bin Lin, Quanlu Zhang, Lingxiao Ma, Yuqing Yang, Fan Yang, Yang Wang, Mao Yang, Lidong Zhou
2022SCQoS-Aware Irregular Collaborative Inference for Improving Throughput of DNN Services.Kaihua Fu, Jiuchen Shi, Quan Chen, Ningxin Zheng, Wei Zhang, Deze Zeng, Minyi Guo
2021ICCDCHARM: Collaborative Host and Accelerator Resource Management for GPU Datacenters.Wei Zhang, Kaihua Fu, Ningxin Zheng, Quan Chen, Chao Li, Wenli Zheng, Minyi Guo
2021Mobisysnn-Meter: towards accurate latency prediction of deep-learning model inference on diverse edge devices.Li Lyna Zhang, Shihao Han, Jianyu Wei, Ningxin Zheng, Ting Cao, Yuqing Yang, Yunxin Liu
2021SCEnable simultaneous DNN services based on deterministic operator overlap and precise latency prediction.Weihao Cui, Han Zhao, Quan Chen, Ningxin Zheng, Jingwen Leng, Jieru Zhao, Zhuo Song, Tao Ma, Yong Yang, Chao Li, Minyi Guo
2020ICPPURSA: Precise Capacity Planning and Fair Scheduling based on Low-level Statistics for Public Clouds.Wei Zhang, Ningxin Zheng, Quan Chen, Yong Yang, Zhuo Song, Tao Ma, Jingwen Leng, Minyi Guo
2018HPCCCLIBE: Precise Cluster-Level I/O Bandwidth Enforcement in Distributed File System.Ningxin Zheng, Quan Chen, Chen Chen, Minyi Guo