Yinghao Yu
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
20
Venues
10
Active years
2016–2026
Best venue rank
A*
Where they publish
Papers
20 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ASPLOS | GFS: A Preemption-aware Scheduling Framework for GPU Clusters with Predictive Spot Instance Management. | Jiaang Duan, Shenglin Xu, Shiyou Qian, Dingyu Yang, Kangjin Wang, Chenzhi Liao, Yinghao Yu, Qin Hua, Hanwen Hu, Qi Wang, Wenchao Wu, Dongqing Bao, Tianyu Lu, Jian Cao, Guangtao Xue, Guodong Yang, Liping Zhang, Gang Chen |
| 2026 | EuroSys | FlashPS: Efficient Generative Image Editing with Mask-aware Caching and Scheduling. | Xiaoxiao Jiang, Suyi Li, Lingyun Yang, Tianyu Feng, Zhipeng Di, Weiyi Lu, Guoxuan Zhu, Xiu Lin, Kan Liu, Yinghao Yu, Tao Lan, Guodong Yang, Lin Qu, Liping Zhang, Wei Wang |
| 2026 | HPCA | eGPU: Production-Scale Elastic Sharing Over 10,000 GPUs. | Xiaochuan Tang, Hao Qi, Jianbo Dong, Yinghao Yu, Zhennan Xue, Zhengyu Zhang, Daocheng Ying, Zheng Cao, Xiaoyi Lu |
| 2026 | NSDI | Medley: Optimizing Midgress Bandwidth for Commercial Live Streaming CDNs. | Haiping Wang, Wanxin Shi, Sandesh Dhawaskar Sathyanarayana, Shu Shi, Feng Qian, Yinghao Yu, La Zuo, Hebin Yu, Ruixiao Zhang, Ruoshi Sun, Yajie Peng, Xiaofei Pang, Ruili Fang, Zhenpeng Zhu, Weiqi Chen, Yang Xu |
| 2026 | NSDI | Attack of the Bubbles: Straggler-Resilient Pipeline Parallelism for Large Model Training. | Tianyuan Wu, Lunxi Cao, Hanfeng Lu, Xiaoxiao Jiang, Yinghao Yu, Siran Yang, Guodong Yang, Jiamang Wang, Lin Qu, Liping Zhang, Wei Wang |
| 2025 | NSDI | GPU-Disaggregated Serving for Deep Learning Recommendation Models at Scale. | Lingyun Yang, Yongchen Wang, Yinghao Yu, Qizhen Weng, Jianbo Dong, Kan Liu, Chi Zhang, Yanyi Zi, Hao Li, Zechao Zhang, Nan Wang, Yu Dong, Menglei Zheng, Lanlan Xi, Xiaowei Lu, Liang Ye, Guodong Yang, Binzhang Fu, Tao Lan, Liping Zhang, Lin Qu, Wei Wang |
| 2025 | USENIX | Katz: Efficient Workflow Serving for Diffusion Models with Many Adapters. | Suyi Li, Lingyun Yang, Xiaoxiao Jiang, Hanfeng Lu, Dakai An, Zhipeng Di, Weiyi Lu, Jiawei Chen, Kan Liu, Yinghao Yu, Tao Lan, Guodong Yang, Lin Qu, Liping Zhang, Wei Wang |
| 2025 | USENIX | GREYHOUND: Hunting Fail-Slows in Hybrid-Parallel Training at Scale. | Tianyuan Wu, Wei Wang, Yinghao Yu, Siran Yang, Wenchao Wu, Qinkai Duan, Guodong Yang, Jiamang Wang, Lin Qu, Liping Zhang |
| 2023 | USENIX | Beware of Fragmentation: Scheduling GPU-Sharing Workloads with Fragmentation Gradient Descent. | Qizhen Weng, Lingyun Yang, Yinghao Yu, Wei Wang, Xiaochuan Tang, Guodong Yang, Liping Zhang |
| 2022 | CLOUD | Workload consolidation in alibaba clusters: the good, the bad, and the ugly. | Yongkang Zhang, Yinghao Yu, Wei Wang, Qiukai Chen, Jie Wu, Zuowei Zhang, Jiang Zhong, Tianchen Ding, Qizhen Weng, Lingyun Yang, Cheng Wang, Jian He, Guodong Yang, Liping Zhang |
| 2022 | NSDI | MLaaS in the Wild: Workload Analysis and Scheduling in Large-Scale Heterogeneous GPU Clusters. | Qizhen Weng, Wencong Xiao, Yinghao Yu, Wei Wang, Cheng Wang, Jian He, Yong Li, Liping Zhang, Wei Lin, Yu Ding |
| 2021 | CLOUD | George: Learning to Place Long-Lived Containers in Large Clusters with Operation Constraints. | Suyi Li, Luping Wang, Wei Wang, Yinghao Yu, Bo Li |
| 2021 | CLOUD | Morphling: Fast, Near-Optimal Auto-Configuration for Cloud-Native Model Serving. | Luping Wang, Lingyun Yang, Yinghao Yu, Wei Wang, Bo Li, Xianchao Sun, Jian He, Liping Zhang |
| 2020 | INFOCOM | RepBun: Load-Balanced, Shuffle-Free Cluster Caching for Structured Data. | Minchen Yu, Yinghao Yu, Yunchuan Zheng, Baichen Yang, Wei Wang |
| 2019 | ICDCS | LACS: Load-Aware Cache Sharing with Isolation Guarantee. | Yinghao Yu, Wei Wang, Jun Zhang, Khaled Ben Letaief |
| 2018 | ICDCS | OpuS: Fair and Efficient Cache Sharing for In-Memory Data Analytics. | Yinghao Yu, Wei Wang, Jun Zhang, Qizhen Weng, Khaled Ben Letaief |
| 2018 | SC | SP-cache: load-balanced, redundancy-free cluster caching with selective partition. | Yinghao Yu, Renfei Huang, Wei Wang, Jun Zhang, Khaled Ben Letaief |
| 2017 | GLOBECOM | LERC: Coordinated Cache Management for Data-Parallel Systems. | Yinghao Yu, Wei Wang, Jun Zhang, Khaled Ben Letaief |
| 2017 | INFOCOM | LRC: Dependency-aware cache management for data analytics clusters. | Yinghao Yu, Wei Wang, Jun Zhang, Khaled Ben Letaief |
| 2016 | GLOBECOM | Joint Subcarrier and CPU Time Allocation for Mobile Edge Computing. | Yinghao Yu, Jun Zhang, Khaled Ben Letaief |