| 2026 | EuroSys | FlexPipe: Adapting Dynamic LLM Serving Through Inflight Pipeline Refactoring in Fragmented Serverless Clusters. | Yanying Lin, Shijie Peng, Chengzhi Lu, ChengZhong Xu, Kejiang Ye |
| 2026 | ISCA | DynoPipe: Heterogeneous Edge-Cloud LLM Serving with Dynamically Orchestrated Pipeline Boundaries. | Yanying Lin, Baicheng Chen, Xinyu Zhang, Cheng-Zhong Xu, Kejiang Ye |
| 2026 | SIGCOMM | Connex: Endpoint Mobility Primitives for Dynamic LLM Serving. | Yanying Lin, Vincent Liu, Tao Luo, ChengZhong Xu, Kejiang Ye |
| 2025 | CLOUD | Understanding Diffusion Model Serving in Production: A Top-Down Analysis of Workload, Scheduling, and Resource Efficiency. | Yanying Lin, Shuaipeng Wu, Shutian Luo, Hong Xu, Haiying Shen, Chong Ma, Min Shen, Le Chen, Chengzhong Xu, Lin Qu, Kejiang Ye |
| 2025 | CLUSTER | Rock: Serving Multimodal Models in Cloud with Heterogeneous-Aware Resource Orchestration for Thousands of LoRA Adapters. | Shuaipeng Wu, Yanying Lin, Shijie Peng, Wenyan Chen, Chong Ma, Min Shen, Le Chen, Chengzhong Xu, Kejiang Ye |
| 2024 | CSCWD | EINS: Edge-Cloud Deep Model Inference with Network-Efficiency Schedule in Serverless. | Shijie Peng, Yanying Lin, Wenyan Chen, Yingfei Tang, Xu Duan, Kejiang Ye |
| 2024 | ICDCS | QUART: Latency-Aware FaaS System for Pipelining Large Model Inference. | Yanying Lin, Yanbo Li, Shijie Peng, Yingfei Tang, Shutian Luo, Haiying Shen, Cheng-Zhong Xu, Kejiang Ye |
| 2024 | ICWS | Planck: Optimizing LLM Inference Performance in Pipeline Parallelism with Fine-Grained SLO Constraint. | Yanying Lin, Shijie Peng, Shuaipeng Wu, Yanbo Li, Chengzhi Lu, Chengzhong Xu, Kejiang Ye |
| 2023 | ICPADS | FLASH: Low-Latency Serverless Model Inference with Multi-Core Parallelism in Edge. | Yanbo Li, Yanying Lin, Shijie Peng, Yingfei Tang, Tian Xiang, Wei Song, Kejiang Ye |
| 2022 | HPCC | ESBench: Understanding Deep Learning Inference Overheads for Edge Serverless. | Yanying Lin, Junhong Chen, Yang Wang, Kejiang Ye |
| 2022 | ISPA | System-level Implications of Serverless: Workload Characterizing and Performance Understanding. | Deshi Deng, Yanying Lin, Kejiang Ye |
| 2021 | HPCC | PEAN: A Packet-level End-to-end Attentive Network for Encrypted Traffic Identification. | Peng Lin, Yishen Hu, Yanying Lin, Kejiang Ye, Cheng-Zhong Xu |
| 2020 | ICPADS | LBNN: Perceiving the State Changes of a Core Telecommunications Network via Linear Bayesian Neural Network. | Yanying Lin, Kejiang Ye, Ming Chen, Naitian Deng, Tailin Wu, Cheng-Zhong Xu |