Yanghua Peng
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
23
Venues
11
Active years
2017–2026
Best venue rank
A*
Where they publish
Papers
23 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | OmniScale: Scaling Any Modality Model Training with Model-Centric Distributed Recipe Zoo. | Qianli Ma, Yaowei Zheng, Zhelun Shi, Zhongkai Zhao, Bin Jia, Ziyue Huang, Zhiqi Lin, Youjie Li, Jiacheng Yang, Yanghua Peng, Zhi Zhang, Xin Liu |
| 2026 | EuroSys | MegaScale-MoE: Large-Scale Communication-Efficient Training of Mixture-of-Experts Models in Production. | Chao Jin, Ziheng Jiang, Zhihao Bai, Zheng Zhong, Juncai Liu, Xiang Li, Ningxin Zheng, Xi Wang, Cong Xie, Qi Huang, Wen Heng, Yiyuan Ma, Wenlei Bao, Size Zheng, Xuegui Zheng, Yanghua Peng, Haibin Lin, Xuanzhe Liu, Xin Jin, Xin Liu |
| 2026 | EuroSys | Laminar: A Scalable Asynchronous RL Post-Training Framework. | Guangming Sheng, Yuxuan Tong, Borui Wan, Wang Zhang, Chaobo Jia, Xibin Wu, Yuqi Wu, Xiang Li, Chi Zhang, Yanghua Peng, Haibin Lin, Xin Liu, Chuan Wu |
| 2026 | EuroSys | MegaScale-Omni: A Hyper-Scale, Workload-Resilient System for MultiModal LLM Training in Production. | Chunyu Xue, Yangrui Chen, Jianyu Jiang, Ningxin Zheng, Junda Feng, Jingji Chen, Shixiong Zhao, Shen Yan, Yi Lin, Lei Shi, Zanbo Wang, Lishu Luo, Faming Wu, Haibin Lin, Yanghua Peng, Xin Liu, Quan Chen |
| 2026 | EuroSys | MegaScale-Data: Scaling DataLoader for Multisource Large Foundation Model Training. | Juntao Zhao, Qi Lu, Wei Jia, Borui Wan, Lei Zuo, Junda Feng, Jianyu Jiang, Yangrui Chen, Shuaishuai Cao, Jialing He, Kaihua Jiang, Yuanzhe Hu, Shibiao Nong, Yanghua Peng, Haibin Lin, Chuan Wu |
| 2025 | CLUSTER | SplitQuant: Resource-Efficient LLM Offline Serving on Heterogeneous GPUs via Phase-Aware Model Partition and Adaptive Quantization. | Juntao Zhao, Borui Wan, Yanghua Peng, Haibin Lin, Chuan Wu |
| 2025 | CVPR | Goku: Flow Based Video Generative Foundation Models. | Shoufa Chen, Chongjian Ge, Yuqi Zhang, Yida Zhang, Fengda Zhu, Hao Yang, Hongxiang Hao, Hui Wu, Zhichao Lai, Yifei Hu, Ting-Che Lin, Shilong Zhang, Fu Li, Chuan Li, Xing Wang, Yanghua Peng, Peize Sun, Ping Luo, Yi Jiang, Zehuan Yuan, Bingyue Peng, Xiaobing Liu |
| 2025 | EuroSys | HybridFlow: A Flexible and Efficient RLHF Framework. | Guangming Sheng, Chi Zhang, Zilingfeng Ye, Xibin Wu, Wang Zhang, Ru Zhang, Yanghua Peng, Haibin Lin, Chuan Wu |
| 2025 | NSDI | ByteCheckpoint: A Unified Checkpointing System for Large Foundation Model Development. | Borui Wan, Mingji Han, Yiyao Sheng, Yanghua Peng, Haibin Lin, Mofan Zhang, Zhichao Lai, Menghan Yu, Junda Zhang, Zuquan Song, Xin Liu, Chuan Wu |
| 2025 | USENIX | Optimus: Accelerating Large-Scale Multi-Modal LLM Training by Bubble Exploitation. | Weiqi Feng, Yangrui Chen, Shaoyu Wang, Yanghua Peng, Haibin Lin, Minlan Yu |
| 2025 | SOSP | Robust LLM Training Infrastructure at ByteDance. | Borui Wan, Gaohong Liu, Zuquan Song, Jun Wang, Yun Zhang, Guangming Sheng, Shuguang Wang, Houmin Wei, Chenyuan Wang, Weiqiang Lou, Xi Yang, Mofan Zhang, Kaihua Jiang, Cheng Ren, Xiaoyun Zhi, Menghan Yu, Zhe Nan, Zhuolin Zheng, Baoquan Zhong, Qinlong Wang, Huan Yu, Jinxin Chi, Wang Zhang, Yuhan Li, Zixian Du, Sida Zhao, Yongqiang Zhang, Jingzhe Tang, Zherui Liu, Chuan Wu, Yanghua Peng, Haibin Lin, Wencong Xiao, Xin Liu, Liang Xiang |
| 2024 | EuroSys | CDMPP: A Device-Model Agnostic Framework for Latency Prediction of Tensor Programs. | Hanpeng Hu, Junwei Su, Juntao Zhao, Yanghua Peng, Yibo Zhu, Haibin Lin, Chuan Wu |
| 2024 | NSDI | MegaScale: Scaling Large Language Model Training to More Than 10, 000 GPUs. | Ziheng Jiang, Haibin Lin, Yinmin Zhong, Qi Huang, Yangrui Chen, Zhi Zhang, Yanghua Peng, Xiang Li, Cong Xie, Shibiao Nong, Yulu Jia, Sun He, Hongmin Chen, Zhihao Bai, Qi Hou, Shipeng Yan, Ding Zhou, Yiyao Sheng, Zhuo Jiang, Haohan Xu, Haoran Wei, Zhang Zhang, Pengfei Nie, Leqi Zou, Sida Zhao, Liang Xiang, Zherui Liu, Zhe Li, Xiaoying Jia, Jianxi Ye, Xin Jin, Xin Liu |
| 2024 | PPoPP | POSTER: LLM-PQ: Serving LLM on Heterogeneous Clusters with Phase-Aware Partition and Adaptive Quantization. | Juntao Zhao, Borui Wan, Chuan Wu, Yanghua Peng, Haibin Lin |
| 2023 | NSDI | BGL: GPU-Efficient GNN Training by Optimizing Graph Data I/O and Preprocessing. | Tianfeng Liu, Yangrui Chen, Dan Li, Chuan Wu, Yibo Zhu, Jun He, Yanghua Peng, Hongzheng Chen, Hongzhi Chen, Chuanxiong Guo |
| 2022 | SIGCOMM | Multi-resource interleaving for deep learning training. | Yihao Zhao, Yuanqiang Liu, Yanghua Peng, Yibo Zhu, Xuanzhe Liu, Xin Jin |
| 2020 | CLOUD | Elastic parameter server load distribution in deep learning clusters. | Yangrui Chen, Yanghua Peng, Yixin Bao, Chuan Wu, Yibo Zhu, Chuanxiong Guo |
| 2020 | INFOCOM | Preemptive All-reduce Scheduling for Expediting Distributed DNN Training. | Yixin Bao, Yanghua Peng, Yangrui Chen, Chuan Wu |
| 2019 | INFOCOM | Deep Learning-based Job Placement in Distributed Machine Learning Clusters. | Yixin Bao, Yanghua Peng, Chuan Wu |
| 2019 | SOSP | A generic communication scheduler for distributed DNN training acceleration. | Yanghua Peng, Yibo Zhu, Yangrui Chen, Yixin Bao, Bairen Yi, Chang Lan, Chuan Wu, Chuanxiong Guo |
| 2018 | EuroSys | Optimus: an efficient dynamic resource scheduler for deep learning clusters. | Yanghua Peng, Yixin Bao, Yangrui Chen, Chuan Wu, Chuanxiong Guo |
| 2018 | INFOCOM | Online Job Scheduling in Distributed Machine Learning Clusters. | Yixin Bao, Yanghua Peng, Chuan Wu, Zongpeng Li |
| 2017 | USENIX | deTector: a Topology-aware Monitoring System for Data Center Networks. | Yanghua Peng, Ji Yang, Chuan Wu, Chuanxiong Guo, Chengchen Hu, Zongpeng Li |