Xupeng Miao
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
39
Venues
17
Active years
2019–2026
Best venue rank
A*
Where they publish
Papers
39 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | EuroSys | AdaServe: Accelerating Multi-SLO LLM Serving with SLO-Customized Speculative Decoding. | Zikun Li, Zhuofu Chen, Remi Delacourt, Gabriele Oliaro, Zeyu Wang, Qinghan Chen, Shuhuai Lin, April Yang, Zhihao Zhang, Zhuoming Chen, Yi-Hsiang Lai, Xinhao Cheng, Xupeng Miao, Zhihao Jia |
| 2026 | ICDE | DistVec: Efficient Distributed Machine Learning in Parallel Database Systems. | Xinyi Zhang, Liangzu Liu, Xupeng Miao, Yinjun Wu, Zhen Chen, Wei Lu, Xiaoyong Du, Bin Cui |
| 2026 | NSDI | FlexLLM: Token-Level Co-Serving of LLM Inference and Finetuning with SLO Guarantees. | Gabriele Oliaro, Xupeng Miao, Xinhao Cheng, Vineeth Kada, Mengdi Wu, Ruohan Gao, Yingyi Huang, Remi Delacourt, April Yang, Yingcheng Wang, Colin Unger, Zhihao Jia |
| 2025 | ASPLOS | GraphPipe: Improving Performance and Scalability of DNN Training with Graph Pipeline Parallelism. | Byungsoo Jeon, Mengdi Wu, Shiyi Cao, Sunghyun Kim, Sunghyun Park, Neeraj Aggarwal, Colin Unger, Daiyaan Arfeen, Peiyuan Liao, Xupeng Miao, Mohammad Alizadeh, Gregory R. Ganger, Tianqi Chen, Zhihao Jia |
| 2025 | ASPLOS | Helix: Serving Large Language Models over Heterogeneous GPUs and Network via Max-Flow. | Yixuan Mei, Yonghao Zhuang, Xupeng Miao, Juncheng Yang, Zhihao Jia, Rashmi Vinayak |
| 2025 | ASPLOS | Spindle: Efficient Distributed Training of Multi-Task Large Models via Wavefront Scheduling. | Yujie Wang, Shenhan Zhu, Fangcheng Fu, Xupeng Miao, Jie Zhang, Juan Zhu, Fan Hong, Yong Li, Bin Cui |
| 2025 | ICLR | NetMoE: Accelerating MoE Training through Dynamic Sample Placement. | Xinyi Liu, Yujie Wang, Fangcheng Fu, Xupeng Miao, Shenhan Zhu, Xiaonan Nie, Bin Cui |
| 2025 | ICML | Demystifying Cost-Efficiency in LLM Serving over Heterogeneous GPUs. | Youhe Jiang, Fangcheng Fu, Xiaozhe Yao, Guoliang He, Xupeng Miao, Ana Klimovic, Bin Cui, Binhang Yuan, Eiko Yoneki |
| 2025 | OSDI | Mirage: A Multi-Level Superoptimizer for Tensor Programs. | Mengdi Wu, Xinhao Cheng, Shengyu Liu, Chunan Shi, Jianan Ji, Man Kit Ao, Praveen Velliengiri, Xupeng Miao, Oded Padon, Zhihao Jia |
| 2024 | AAAI | Accelerating Text-to-Image Editing via Cache-Enabled Sparse Diffusion Inference. | Zihao Yu, Haoyang Li, Fangcheng Fu, Xupeng Miao, Bin Cui |
| 2024 | ACL | Quantized Side Tuning: Fast and Memory-Efficient Tuning of Quantized Large Language Models. | Zhengxin Zhang, Dan Zhao, Xupeng Miao, Gabriele Oliaro, Zhihao Zhang, Qing Li, Yong Jiang, Zhihao Jia |
| 2024 | ASPLOS | Optimal Kernel Orchestration for Tensor Programs with Korch. | Muyan Hu, Ashwin Venkatram, Shreyashri Biswas, Balamurugan Marimuthu, Bohan Hou, Gabriele Oliaro, Haojie Wang, Liyan Zheng, Xupeng Miao, Jidong Zhai, Zhihao Jia |
| 2024 | ASPLOS | SpecInfer: Accelerating Large Language Model Serving with Tree-based Speculative Inference and Verification. | Xupeng Miao, Gabriele Oliaro, Zhihao Zhang, Xinhao Cheng, Zeyu Wang, Zhengxin Zhang, Rae Ying Yee Wong, Alan Zhu, Lijie Yang, Xiaoxiang Shi, Chunan Shi, Zhuoming Chen, Daiyaan Arfeen, Reyna Abhyankar, Zhihao Jia |
| 2024 | ASPLOS | SpotServe: Serving Generative Large Language Models on Preemptible Instances. | Xupeng Miao, Chunan Shi, Jiangfei Duan, Xiaoli Xi, Dahua Lin, Bin Cui, Zhihao Jia |
| 2024 | EACL | Generative Dense Retrieval: Memory Can Be a Burden. | Peiwen Yuan, Xinglin Wang, Shaoxiong Feng, Boyuan Pan, Yiwei Li, Heda Wang, Xupeng Miao, Kan Li |
| 2024 | ICDE | MFIX: An Efficient and Reliable Index Advisor via Multi-Fidelity Bayesian Optimization. | Zhuo Chang, Xinyi Zhang, Yang Li, Xupeng Miao, Yanzhao Qin, Bin Cui |
| 2024 | IJCAI | X-former Elucidator: Reviving Efficient Attention for Long Context Language Modeling. | Xupeng Miao, Shenhan Zhu, Fangcheng Fu, Ziyu Guo, Zhi Yang, Yaofeng Tu, Zhihao Jia, Bin Cui |
| 2024 | NSDI | Parcae: Proactive, Liveput-Optimized DNN Training on Preemptible Instances. | Jiangfei Duan, Ziang Song, Xupeng Miao, Xiaoli Xi, Dahua Lin, Harry Xu, Minjia Zhang, Zhihao Jia |
| 2024 | SC | Atlas: Hierarchical Partitioning for Quantum Circuit Simulation on GPUs. | Mingkuan Xu, Shiyi Cao, Xupeng Miao, Umut A. Acar, Zhihao Jia |
| 2024 | SIGMOD | Demystifying Data Management for Large Language Models. | Xupeng Miao, Zhihao Jia, Bin Cui |
| 2024 | SOSP | Enabling Parallelism Hot Switching for Efficient Training of Large Language Models. | Hao Ge, Fangcheng Fu, Haoyang Li, Xuanyu Wang, Sheng Lin, Yujie Wang, Xiaonan Nie, Hailin Zhang, Xupeng Miao, Bin Cui |
| 2023 | AAAI | CALIP: Zero-Shot Enhancement of CLIP with Parameter-Free Attention. | Ziyu Guo, Renrui Zhang, Longtian Qiu, Xianzheng Ma, Xupeng Miao, Xuming He, Bin Cui |
| 2023 | IJCAI | OSDP: Optimal Sharded Data Parallel for Distributed Deep Learning. | Youhe Jiang, Fangcheng Fu, Xupeng Miao, Xiaonan Nie, Bin Cui |
| 2023 | OSDI | EINNET: Optimizing Tensor Programs with Derivation-Based Transformations. | Liyan Zheng, Haojie Wang, Jidong Zhai, Muyan Hu, Zixuan Ma, Tuowei Wang, Shuhong Huang, Xupeng Miao, Shizhi Tang, Kezhao Huang, Zhihao Jia |
| 2022 | CIKM | Scalable Graph Sampling on GPUs with Compressed Graph. | Hongbo Yin, Yingxia Shao, Xupeng Miao, Yawen Li, Bin Cui |
| 2022 | CVPR | PointCLIP: Point Cloud Understanding by CLIP. | Renrui Zhang, Ziyu Guo, Wei Zhang, Kunchang Li, Xupeng Miao, Bin Cui, Yu Qiao, Peng Gao, Hongsheng Li |
| 2022 | ICDE | HET-KG: Communication-Efficient Knowledge Graph Embedding Training via Hotness-Aware Cache. | Sicong Dong, Xupeng Miao, Pengkai Liu, Xin Wang, Bin Cui, Jianxin Li |
| 2022 | ICDE | Zoomer: Boosting Retrieval on Web-scale Graphs by Regions of Interest. | Yuezihan Jiang, Yu Cheng, Hanyu Zhao, Wentao Zhang, Xupeng Miao, Yu He, Liang Wang, Zhi Yang, Bin Cui |
| 2022 | ICDE | Lasagne: A Multi-Layer Graph Convolutional Network Framework via Node-aware Deep Architecture (Extended Abstract). | Xupeng Miao, Wentao Zhang, Yingxia Shao, Bin Cui, Lei Chen, Ce Zhang, Jiawei Jiang |
| 2022 | ICDE | TSPLIT: Fine-grained GPU Memory Management for Efficient DNN Training via Tensor Splitting. | Xiaonan Nie, Xupeng Miao, Zhi Yang, Bin Cui |
| 2022 | SIGMOD | HET-GMP: A Graph-based System Approach to Scaling Large Embedding Model Training. | Xupeng Miao, Yining Shi, Hailin Zhang, Xin Zhang, Xiaonan Nie, Zhi Yang, Bin Cui |
| 2021 | ICDE | CuWide: Towards Efficient Flow-based Training for Sparse Wide Models on GPUs (Extended Abstract). | Xupeng Miao, Lingxiao Ma, Zhi Yang, Yingxia Shao, Bin Cui, Lele Yu, Jiawei Jiang |
| 2021 | KDD | DeGNN: Improving Graph Neural Networks with Graph Decomposition. | Xupeng Miao, Nezihe Merve Grel, Wentao Zhang, Zhichao Han, Bo Li, Wei Min, Susie Xi Rao, Hansheng Ren, Yinan Shan, Yingxia Shao, Yujie Wang, Fan Wu, Hui Xue, Yaming Yang, Zitao Zhang, Yang Zhao, Shuai Zhang, Yujing Wang, Bin Cui, Ce Zhang |
| 2021 | KDD | ROD: Reception-aware Online Distillation for Sparse Graphs. | Wentao Zhang, Yuezihan Jiang, Yang Li, Zeang Sheng, Yu Shen, Xupeng Miao, Liang Wang, Zhi Yang, Bin Cui |
| 2021 | SIGMOD | Heterogeneity-Aware Distributed Machine Learning Training via Partial Reduce. | Xupeng Miao, Xiaonan Nie, Yingxia Shao, Zhi Yang, Jiawei Jiang, Lingxiao Ma, Bin Cui |
| 2020 | ICDE | PSGraph: How Tencent trains extremely large-scale graphs with Spark? | Jiawei Jiang, Pin Xiao, Lele Yu, Xiaosen Li, Jiefeng Cheng, Xupeng Miao, Zhipeng Zhang, Bin Cui |
| 2020 | SIGMOD | Memory-Aware Framework for Efficient Second-Order Random Walk on Large Graphs. | Yingxia Shao, Shiyue Huang, Xupeng Miao, Bin Cui, Lei Chen |
| 2020 | SIGMOD | Reliable Data Distillation on Graph Convolutional Network. | Wentao Zhang, Xupeng Miao, Yingxia Shao, Jiawei Jiang, Lei Chen, Olivier Ruas, Bin Cui |
| 2019 | SIGMOD | PS2: Parameter Server on Spark. | Zhipeng Zhang, Bin Cui, Yingxia Shao, Lele Yu, Jiawei Jiang, Xupeng Miao |