Ningxin Zheng
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
16
Venues
12
Active years
2018–2026
Best venue rank
A*
Where they publish
Papers
16 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | EuroSys | MegaScale-MoE: Large-Scale Communication-Efficient Training of Mixture-of-Experts Models in Production. | Chao Jin, Ziheng Jiang, Zhihao Bai, Zheng Zhong, Juncai Liu, Xiang Li, Ningxin Zheng, Xi Wang, Cong Xie, Qi Huang, Wen Heng, Yiyuan Ma, Wenlei Bao, Size Zheng, Xuegui Zheng, Yanghua Peng, Haibin Lin, Xuanzhe Liu, Xin Jin, Xin Liu |
| 2026 | EuroSys | MegaScale-Omni: A Hyper-Scale, Workload-Resilient System for MultiModal LLM Training in Production. | Chunyu Xue, Yangrui Chen, Jianyu Jiang, Ningxin Zheng, Junda Feng, Jingji Chen, Shixiong Zhao, Shen Yan, Yi Lin, Lei Shi, Zanbo Wang, Lishu Luo, Faming Wu, Haibin Lin, Yanghua Peng, Xin Liu, Quan Chen |
| 2025 | ICML | ShadowKV: KV Cache in Shadows for High-Throughput Long-Context LLM Inference. | Hanshi Sun, Li-Wen Chang, Wenlei Bao, Size Zheng, Ningxin Zheng, Xin Liu, Harry Dong, Yuejie Chi, Beidi Chen |
| 2024 | OSDI | Ladder: Enabling Efficient Low-Precision Deep Learning Computing through Hardware-aware Tensor Transformation. | Lei Wang, Lingxiao Ma, Shijie Cao, Quanlu Zhang, Jilong Xue, Yining Shi, Ningxin Zheng, Ziming Miao, Fan Yang, Ting Cao, Yuqing Yang, Mao Yang |
| 2023 | CVPR | EfficientViT: Memory Efficient Vision Transformer with Cascaded Group Attention. | Xinyu Liu, Houwen Peng, Ningxin Zheng, Yuqing Yang, Han Hu, Yixuan Yuan |
| 2023 | ICCV | SpaceEvo: Hardware-Friendly Search Space Design for Efficient INT8 Inference. | Xudong Wang, Li Lyna Zhang, Jiahang Xu, Quanlu Zhang, Yujing Wang, Yuqing Yang, Ningxin Zheng, Ting Cao, Mao Yang |
| 2023 | OSDI | Optimizing Dynamic Neural Networks with Brainstorm. | Weihao Cui, Zhenhua Han, Lingji Ouyang, Yichuan Wang, Ningxin Zheng, Lingxiao Ma, Yuqing Yang, Fan Yang, Jilong Xue, Lili Qiu, Lidong Zhou, Quan Chen, Haisheng Tan, Minyi Guo |
| 2023 | SOSP | PIT: Optimization of Dynamic Sparse Deep Learning Models via Permutation Invariant Transformation. | Ningxin Zheng, Huiqiang Jiang, Quanlu Zhang, Zhenhua Han, Lingxiao Ma, Yuqing Yang, Fan Yang, Chengruidong Zhang, Lili Qiu, Mao Yang, Lidong Zhou |
| 2022 | ASPLOS | Astraea: towards QoS-aware and resource-efficient multi-stage GPU services. | Wei Zhang, Quan Chen, Kaihua Fu, Ningxin Zheng, Zhiyi Huang, Jingwen Leng, Minyi Guo |
| 2022 | OSDI | SparTA: Deep-Learning Model Sparsity via Tensor-with-Sparsity-Attribute. | Ningxin Zheng, Bin Lin, Quanlu Zhang, Lingxiao Ma, Yuqing Yang, Fan Yang, Yang Wang, Mao Yang, Lidong Zhou |
| 2022 | SC | QoS-Aware Irregular Collaborative Inference for Improving Throughput of DNN Services. | Kaihua Fu, Jiuchen Shi, Quan Chen, Ningxin Zheng, Wei Zhang, Deze Zeng, Minyi Guo |
| 2021 | ICCD | CHARM: Collaborative Host and Accelerator Resource Management for GPU Datacenters. | Wei Zhang, Kaihua Fu, Ningxin Zheng, Quan Chen, Chao Li, Wenli Zheng, Minyi Guo |
| 2021 | Mobisys | nn-Meter: towards accurate latency prediction of deep-learning model inference on diverse edge devices. | Li Lyna Zhang, Shihao Han, Jianyu Wei, Ningxin Zheng, Ting Cao, Yuqing Yang, Yunxin Liu |
| 2021 | SC | Enable simultaneous DNN services based on deterministic operator overlap and precise latency prediction. | Weihao Cui, Han Zhao, Quan Chen, Ningxin Zheng, Jingwen Leng, Jieru Zhao, Zhuo Song, Tao Ma, Yong Yang, Chao Li, Minyi Guo |
| 2020 | ICPP | URSA: Precise Capacity Planning and Fair Scheduling based on Low-level Statistics for Public Clouds. | Wei Zhang, Ningxin Zheng, Quan Chen, Yong Yang, Zhuo Song, Tao Ma, Jingwen Leng, Minyi Guo |
| 2018 | HPCC | CLIBE: Precise Cluster-Level I/O Bandwidth Enforcement in Distributed File System. | Ningxin Zheng, Quan Chen, Chen Chen, Minyi Guo |