Skip to content

Xupeng Miao

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

39

Venues

17

Active years

2019–2026

Best venue rank

A*

Where they publish

Papers

39 indexed papers, newest first.

YearVenueTitleAuthors
2026EuroSysAdaServe: Accelerating Multi-SLO LLM Serving with SLO-Customized Speculative Decoding.Zikun Li, Zhuofu Chen, Remi Delacourt, Gabriele Oliaro, Zeyu Wang, Qinghan Chen, Shuhuai Lin, April Yang, Zhihao Zhang, Zhuoming Chen, Yi-Hsiang Lai, Xinhao Cheng, Xupeng Miao, Zhihao Jia
2026ICDEDistVec: Efficient Distributed Machine Learning in Parallel Database Systems.Xinyi Zhang, Liangzu Liu, Xupeng Miao, Yinjun Wu, Zhen Chen, Wei Lu, Xiaoyong Du, Bin Cui
2026NSDIFlexLLM: Token-Level Co-Serving of LLM Inference and Finetuning with SLO Guarantees.Gabriele Oliaro, Xupeng Miao, Xinhao Cheng, Vineeth Kada, Mengdi Wu, Ruohan Gao, Yingyi Huang, Remi Delacourt, April Yang, Yingcheng Wang, Colin Unger, Zhihao Jia
2025ASPLOSGraphPipe: Improving Performance and Scalability of DNN Training with Graph Pipeline Parallelism.Byungsoo Jeon, Mengdi Wu, Shiyi Cao, Sunghyun Kim, Sunghyun Park, Neeraj Aggarwal, Colin Unger, Daiyaan Arfeen, Peiyuan Liao, Xupeng Miao, Mohammad Alizadeh, Gregory R. Ganger, Tianqi Chen, Zhihao Jia
2025ASPLOSHelix: Serving Large Language Models over Heterogeneous GPUs and Network via Max-Flow.Yixuan Mei, Yonghao Zhuang, Xupeng Miao, Juncheng Yang, Zhihao Jia, Rashmi Vinayak
2025ASPLOSSpindle: Efficient Distributed Training of Multi-Task Large Models via Wavefront Scheduling.Yujie Wang, Shenhan Zhu, Fangcheng Fu, Xupeng Miao, Jie Zhang, Juan Zhu, Fan Hong, Yong Li, Bin Cui
2025ICLRNetMoE: Accelerating MoE Training through Dynamic Sample Placement.Xinyi Liu, Yujie Wang, Fangcheng Fu, Xupeng Miao, Shenhan Zhu, Xiaonan Nie, Bin Cui
2025ICMLDemystifying Cost-Efficiency in LLM Serving over Heterogeneous GPUs.Youhe Jiang, Fangcheng Fu, Xiaozhe Yao, Guoliang He, Xupeng Miao, Ana Klimovic, Bin Cui, Binhang Yuan, Eiko Yoneki
2025OSDIMirage: A Multi-Level Superoptimizer for Tensor Programs.Mengdi Wu, Xinhao Cheng, Shengyu Liu, Chunan Shi, Jianan Ji, Man Kit Ao, Praveen Velliengiri, Xupeng Miao, Oded Padon, Zhihao Jia
2024AAAIAccelerating Text-to-Image Editing via Cache-Enabled Sparse Diffusion Inference.Zihao Yu, Haoyang Li, Fangcheng Fu, Xupeng Miao, Bin Cui
2024ACLQuantized Side Tuning: Fast and Memory-Efficient Tuning of Quantized Large Language Models.Zhengxin Zhang, Dan Zhao, Xupeng Miao, Gabriele Oliaro, Zhihao Zhang, Qing Li, Yong Jiang, Zhihao Jia
2024ASPLOSOptimal Kernel Orchestration for Tensor Programs with Korch.Muyan Hu, Ashwin Venkatram, Shreyashri Biswas, Balamurugan Marimuthu, Bohan Hou, Gabriele Oliaro, Haojie Wang, Liyan Zheng, Xupeng Miao, Jidong Zhai, Zhihao Jia
2024ASPLOSSpecInfer: Accelerating Large Language Model Serving with Tree-based Speculative Inference and Verification.Xupeng Miao, Gabriele Oliaro, Zhihao Zhang, Xinhao Cheng, Zeyu Wang, Zhengxin Zhang, Rae Ying Yee Wong, Alan Zhu, Lijie Yang, Xiaoxiang Shi, Chunan Shi, Zhuoming Chen, Daiyaan Arfeen, Reyna Abhyankar, Zhihao Jia
2024ASPLOSSpotServe: Serving Generative Large Language Models on Preemptible Instances.Xupeng Miao, Chunan Shi, Jiangfei Duan, Xiaoli Xi, Dahua Lin, Bin Cui, Zhihao Jia
2024EACLGenerative Dense Retrieval: Memory Can Be a Burden.Peiwen Yuan, Xinglin Wang, Shaoxiong Feng, Boyuan Pan, Yiwei Li, Heda Wang, Xupeng Miao, Kan Li
2024ICDEMFIX: An Efficient and Reliable Index Advisor via Multi-Fidelity Bayesian Optimization.Zhuo Chang, Xinyi Zhang, Yang Li, Xupeng Miao, Yanzhao Qin, Bin Cui
2024IJCAIX-former Elucidator: Reviving Efficient Attention for Long Context Language Modeling.Xupeng Miao, Shenhan Zhu, Fangcheng Fu, Ziyu Guo, Zhi Yang, Yaofeng Tu, Zhihao Jia, Bin Cui
2024NSDIParcae: Proactive, Liveput-Optimized DNN Training on Preemptible Instances.Jiangfei Duan, Ziang Song, Xupeng Miao, Xiaoli Xi, Dahua Lin, Harry Xu, Minjia Zhang, Zhihao Jia
2024SCAtlas: Hierarchical Partitioning for Quantum Circuit Simulation on GPUs.Mingkuan Xu, Shiyi Cao, Xupeng Miao, Umut A. Acar, Zhihao Jia
2024SIGMODDemystifying Data Management for Large Language Models.Xupeng Miao, Zhihao Jia, Bin Cui
2024SOSPEnabling Parallelism Hot Switching for Efficient Training of Large Language Models.Hao Ge, Fangcheng Fu, Haoyang Li, Xuanyu Wang, Sheng Lin, Yujie Wang, Xiaonan Nie, Hailin Zhang, Xupeng Miao, Bin Cui
2023AAAICALIP: Zero-Shot Enhancement of CLIP with Parameter-Free Attention.Ziyu Guo, Renrui Zhang, Longtian Qiu, Xianzheng Ma, Xupeng Miao, Xuming He, Bin Cui
2023IJCAIOSDP: Optimal Sharded Data Parallel for Distributed Deep Learning.Youhe Jiang, Fangcheng Fu, Xupeng Miao, Xiaonan Nie, Bin Cui
2023OSDIEINNET: Optimizing Tensor Programs with Derivation-Based Transformations.Liyan Zheng, Haojie Wang, Jidong Zhai, Muyan Hu, Zixuan Ma, Tuowei Wang, Shuhong Huang, Xupeng Miao, Shizhi Tang, Kezhao Huang, Zhihao Jia
2022CIKMScalable Graph Sampling on GPUs with Compressed Graph.Hongbo Yin, Yingxia Shao, Xupeng Miao, Yawen Li, Bin Cui
2022CVPRPointCLIP: Point Cloud Understanding by CLIP.Renrui Zhang, Ziyu Guo, Wei Zhang, Kunchang Li, Xupeng Miao, Bin Cui, Yu Qiao, Peng Gao, Hongsheng Li
2022ICDEHET-KG: Communication-Efficient Knowledge Graph Embedding Training via Hotness-Aware Cache.Sicong Dong, Xupeng Miao, Pengkai Liu, Xin Wang, Bin Cui, Jianxin Li
2022ICDEZoomer: Boosting Retrieval on Web-scale Graphs by Regions of Interest.Yuezihan Jiang, Yu Cheng, Hanyu Zhao, Wentao Zhang, Xupeng Miao, Yu He, Liang Wang, Zhi Yang, Bin Cui
2022ICDELasagne: A Multi-Layer Graph Convolutional Network Framework via Node-aware Deep Architecture (Extended Abstract).Xupeng Miao, Wentao Zhang, Yingxia Shao, Bin Cui, Lei Chen, Ce Zhang, Jiawei Jiang
2022ICDETSPLIT: Fine-grained GPU Memory Management for Efficient DNN Training via Tensor Splitting.Xiaonan Nie, Xupeng Miao, Zhi Yang, Bin Cui
2022SIGMODHET-GMP: A Graph-based System Approach to Scaling Large Embedding Model Training.Xupeng Miao, Yining Shi, Hailin Zhang, Xin Zhang, Xiaonan Nie, Zhi Yang, Bin Cui
2021ICDECuWide: Towards Efficient Flow-based Training for Sparse Wide Models on GPUs (Extended Abstract).Xupeng Miao, Lingxiao Ma, Zhi Yang, Yingxia Shao, Bin Cui, Lele Yu, Jiawei Jiang
2021KDDDeGNN: Improving Graph Neural Networks with Graph Decomposition.Xupeng Miao, Nezihe Merve Grel, Wentao Zhang, Zhichao Han, Bo Li, Wei Min, Susie Xi Rao, Hansheng Ren, Yinan Shan, Yingxia Shao, Yujie Wang, Fan Wu, Hui Xue, Yaming Yang, Zitao Zhang, Yang Zhao, Shuai Zhang, Yujing Wang, Bin Cui, Ce Zhang
2021KDDROD: Reception-aware Online Distillation for Sparse Graphs.Wentao Zhang, Yuezihan Jiang, Yang Li, Zeang Sheng, Yu Shen, Xupeng Miao, Liang Wang, Zhi Yang, Bin Cui
2021SIGMODHeterogeneity-Aware Distributed Machine Learning Training via Partial Reduce.Xupeng Miao, Xiaonan Nie, Yingxia Shao, Zhi Yang, Jiawei Jiang, Lingxiao Ma, Bin Cui
2020ICDEPSGraph: How Tencent trains extremely large-scale graphs with Spark?Jiawei Jiang, Pin Xiao, Lele Yu, Xiaosen Li, Jiefeng Cheng, Xupeng Miao, Zhipeng Zhang, Bin Cui
2020SIGMODMemory-Aware Framework for Efficient Second-Order Random Walk on Large Graphs.Yingxia Shao, Shiyue Huang, Xupeng Miao, Bin Cui, Lei Chen
2020SIGMODReliable Data Distillation on Graph Convolutional Network.Wentao Zhang, Xupeng Miao, Yingxia Shao, Jiawei Jiang, Lei Chen, Olivier Ruas, Bin Cui
2019SIGMODPS2: Parameter Server on Spark.Zhipeng Zhang, Bin Cui, Yingxia Shao, Lele Yu, Jiawei Jiang, Xupeng Miao