Skip to content

Yanghua Peng

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

23

Venues

11

Active years

2017–2026

Best venue rank

A*

Where they publish

Papers

23 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIOmniScale: Scaling Any Modality Model Training with Model-Centric Distributed Recipe Zoo.Qianli Ma, Yaowei Zheng, Zhelun Shi, Zhongkai Zhao, Bin Jia, Ziyue Huang, Zhiqi Lin, Youjie Li, Jiacheng Yang, Yanghua Peng, Zhi Zhang, Xin Liu
2026EuroSysMegaScale-MoE: Large-Scale Communication-Efficient Training of Mixture-of-Experts Models in Production.Chao Jin, Ziheng Jiang, Zhihao Bai, Zheng Zhong, Juncai Liu, Xiang Li, Ningxin Zheng, Xi Wang, Cong Xie, Qi Huang, Wen Heng, Yiyuan Ma, Wenlei Bao, Size Zheng, Xuegui Zheng, Yanghua Peng, Haibin Lin, Xuanzhe Liu, Xin Jin, Xin Liu
2026EuroSysLaminar: A Scalable Asynchronous RL Post-Training Framework.Guangming Sheng, Yuxuan Tong, Borui Wan, Wang Zhang, Chaobo Jia, Xibin Wu, Yuqi Wu, Xiang Li, Chi Zhang, Yanghua Peng, Haibin Lin, Xin Liu, Chuan Wu
2026EuroSysMegaScale-Omni: A Hyper-Scale, Workload-Resilient System for MultiModal LLM Training in Production.Chunyu Xue, Yangrui Chen, Jianyu Jiang, Ningxin Zheng, Junda Feng, Jingji Chen, Shixiong Zhao, Shen Yan, Yi Lin, Lei Shi, Zanbo Wang, Lishu Luo, Faming Wu, Haibin Lin, Yanghua Peng, Xin Liu, Quan Chen
2026EuroSysMegaScale-Data: Scaling DataLoader for Multisource Large Foundation Model Training.Juntao Zhao, Qi Lu, Wei Jia, Borui Wan, Lei Zuo, Junda Feng, Jianyu Jiang, Yangrui Chen, Shuaishuai Cao, Jialing He, Kaihua Jiang, Yuanzhe Hu, Shibiao Nong, Yanghua Peng, Haibin Lin, Chuan Wu
2025CLUSTERSplitQuant: Resource-Efficient LLM Offline Serving on Heterogeneous GPUs via Phase-Aware Model Partition and Adaptive Quantization.Juntao Zhao, Borui Wan, Yanghua Peng, Haibin Lin, Chuan Wu
2025CVPRGoku: Flow Based Video Generative Foundation Models.Shoufa Chen, Chongjian Ge, Yuqi Zhang, Yida Zhang, Fengda Zhu, Hao Yang, Hongxiang Hao, Hui Wu, Zhichao Lai, Yifei Hu, Ting-Che Lin, Shilong Zhang, Fu Li, Chuan Li, Xing Wang, Yanghua Peng, Peize Sun, Ping Luo, Yi Jiang, Zehuan Yuan, Bingyue Peng, Xiaobing Liu
2025EuroSysHybridFlow: A Flexible and Efficient RLHF Framework.Guangming Sheng, Chi Zhang, Zilingfeng Ye, Xibin Wu, Wang Zhang, Ru Zhang, Yanghua Peng, Haibin Lin, Chuan Wu
2025NSDIByteCheckpoint: A Unified Checkpointing System for Large Foundation Model Development.Borui Wan, Mingji Han, Yiyao Sheng, Yanghua Peng, Haibin Lin, Mofan Zhang, Zhichao Lai, Menghan Yu, Junda Zhang, Zuquan Song, Xin Liu, Chuan Wu
2025USENIXOptimus: Accelerating Large-Scale Multi-Modal LLM Training by Bubble Exploitation.Weiqi Feng, Yangrui Chen, Shaoyu Wang, Yanghua Peng, Haibin Lin, Minlan Yu
2025SOSPRobust LLM Training Infrastructure at ByteDance.Borui Wan, Gaohong Liu, Zuquan Song, Jun Wang, Yun Zhang, Guangming Sheng, Shuguang Wang, Houmin Wei, Chenyuan Wang, Weiqiang Lou, Xi Yang, Mofan Zhang, Kaihua Jiang, Cheng Ren, Xiaoyun Zhi, Menghan Yu, Zhe Nan, Zhuolin Zheng, Baoquan Zhong, Qinlong Wang, Huan Yu, Jinxin Chi, Wang Zhang, Yuhan Li, Zixian Du, Sida Zhao, Yongqiang Zhang, Jingzhe Tang, Zherui Liu, Chuan Wu, Yanghua Peng, Haibin Lin, Wencong Xiao, Xin Liu, Liang Xiang
2024EuroSysCDMPP: A Device-Model Agnostic Framework for Latency Prediction of Tensor Programs.Hanpeng Hu, Junwei Su, Juntao Zhao, Yanghua Peng, Yibo Zhu, Haibin Lin, Chuan Wu
2024NSDIMegaScale: Scaling Large Language Model Training to More Than 10, 000 GPUs.Ziheng Jiang, Haibin Lin, Yinmin Zhong, Qi Huang, Yangrui Chen, Zhi Zhang, Yanghua Peng, Xiang Li, Cong Xie, Shibiao Nong, Yulu Jia, Sun He, Hongmin Chen, Zhihao Bai, Qi Hou, Shipeng Yan, Ding Zhou, Yiyao Sheng, Zhuo Jiang, Haohan Xu, Haoran Wei, Zhang Zhang, Pengfei Nie, Leqi Zou, Sida Zhao, Liang Xiang, Zherui Liu, Zhe Li, Xiaoying Jia, Jianxi Ye, Xin Jin, Xin Liu
2024PPoPPPOSTER: LLM-PQ: Serving LLM on Heterogeneous Clusters with Phase-Aware Partition and Adaptive Quantization.Juntao Zhao, Borui Wan, Chuan Wu, Yanghua Peng, Haibin Lin
2023NSDIBGL: GPU-Efficient GNN Training by Optimizing Graph Data I/O and Preprocessing.Tianfeng Liu, Yangrui Chen, Dan Li, Chuan Wu, Yibo Zhu, Jun He, Yanghua Peng, Hongzheng Chen, Hongzhi Chen, Chuanxiong Guo
2022SIGCOMMMulti-resource interleaving for deep learning training.Yihao Zhao, Yuanqiang Liu, Yanghua Peng, Yibo Zhu, Xuanzhe Liu, Xin Jin
2020CLOUDElastic parameter server load distribution in deep learning clusters.Yangrui Chen, Yanghua Peng, Yixin Bao, Chuan Wu, Yibo Zhu, Chuanxiong Guo
2020INFOCOMPreemptive All-reduce Scheduling for Expediting Distributed DNN Training.Yixin Bao, Yanghua Peng, Yangrui Chen, Chuan Wu
2019INFOCOMDeep Learning-based Job Placement in Distributed Machine Learning Clusters.Yixin Bao, Yanghua Peng, Chuan Wu
2019SOSPA generic communication scheduler for distributed DNN training acceleration.Yanghua Peng, Yibo Zhu, Yangrui Chen, Yixin Bao, Bairen Yi, Chang Lan, Chuan Wu, Chuanxiong Guo
2018EuroSysOptimus: an efficient dynamic resource scheduler for deep learning clusters.Yanghua Peng, Yixin Bao, Yangrui Chen, Chuan Wu, Chuanxiong Guo
2018INFOCOMOnline Job Scheduling in Distributed Machine Learning Clusters.Yixin Bao, Yanghua Peng, Chuan Wu, Zongpeng Li
2017USENIXdeTector: a Topology-aware Monitoring System for Data Center Networks.Yanghua Peng, Ji Yang, Chuan Wu, Chuanxiong Guo, Chengchen Hu, Zongpeng Li