| 2026 | EuroSys | High Throughput and Low Latency LLM Serving via Adaptive KV Caching. | Wenyan Chen, Chengzhi Lu, Huanle Xu, Kejiang Ye, ChengZhong Xu |
| 2026 | EuroSys | FlexPipe: Adapting Dynamic LLM Serving Through Inflight Pipeline Refactoring in Fragmented Serverless Clusters. | Yanying Lin, Shijie Peng, Chengzhi Lu, ChengZhong Xu, Kejiang Ye |
| 2026 | INFOCOM | Enabling Fast and Stable Service Mesh Communication via Piggyback Layer-7 Traffic Control on Programmable Switches. | Gonglong Chen, Jiacong Li, Yuxin Xu, Baiyan Ke, Zhitao Lan, Wenxing Ge, Haiying Shen, Jiamei Lv, Tao Gu, Cheng-zhong Xu, Kejiang Ye |
| 2026 | ISCA | DynoPipe: Heterogeneous Edge-Cloud LLM Serving with Dynamically Orchestrated Pipeline Boundaries. | Yanying Lin, Baicheng Chen, Xinyu Zhang, Cheng-Zhong Xu, Kejiang Ye |
| 2026 | IWQoS | Achieving Fast and High Throughput Data Exchange for Serverless Computing Systems via Switch-Native Serialization/Deserialization. | Gonglong Chen, Baiyan Ke, Yuxin Xu, Shenghong Xiong, Haolin Pan, Jiamei Lv, Wenxing Ge, Yuxi Wang, Cheng-Zhong Xu, Kejiang Ye |
| 2026 | SIGCOMM | Connex: Endpoint Mobility Primitives for Dynamic LLM Serving. | Yanying Lin, Vincent Liu, Tao Luo, ChengZhong Xu, Kejiang Ye |
| 2025 | CLOUD | Understanding Diffusion Model Serving in Production: A Top-Down Analysis of Workload, Scheduling, and Resource Efficiency. | Yanying Lin, Shuaipeng Wu, Shutian Luo, Hong Xu, Haiying Shen, Chong Ma, Min Shen, Le Chen, Chengzhong Xu, Lin Qu, Kejiang Ye |
| 2025 | CLUSTER | Scalable and Fast Inference Serving via Hybrid Communication Scheduling on Heterogeneous Networks. | Gonglong Chen, Jiamei Lv, Kejiang Ye, Tao Gu, Cheng-Zhong Xu |
| 2025 | CLUSTER | Rock: Serving Multimodal Models in Cloud with Heterogeneous-Aware Resource Orchestration for Thousands of LoRA Adapters. | Shuaipeng Wu, Yanying Lin, Shijie Peng, Wenyan Chen, Chong Ma, Min Shen, Le Chen, Chengzhong Xu, Kejiang Ye |
| 2025 | EMNLP | Mixture of Weight-shared Heterogeneous Group Attention Experts for Dynamic Token-wise KV Optimization. | Guanghui Song, Dongping Liao, Yiren Zhao, Kejiang Ye, Chengzhong Xu, Xitong Gao |
| 2025 | EuroSys | Multiplexing Dynamic Deep Learning Workloads with SLO-awareness in GPU Clusters. | Wenyan Chen, Chengzhi Lu, Huanle Xu, Kejiang Ye, Chengzhong Xu |
| 2025 | ICASSP | Clutter Resilient Occlusion Avoidance for Tightly-Coupled Motion-Assisted Detection. | Zhixuan Xie, Jianjun Chen, Guoliang Li, Shuai Wang, Kejiang Ye, Yonina C. Eldar, Chengzhong Xu |
| 2025 | ICCCN | SealOS+: A Sealos-based Approach for Adaptive Resource Optimization Under Dynamic Workloads for Securities Trading System. | Haojie Jia, Zhenhao Li, Gen Li, Minxian Xu, Kejiang Ye |
| 2025 | IJCNN | Incremental Tucker Decomposition for Scalable and Efficient Multilingual Speech Recognition. | Guanghui Song, Ye Hong, Xitong Gao, Juanjuan Zhao, Kejiang Ye |
| 2025 | INFOCOM | Green Robotic Mixed Reality with Gaussian Splatting. | Chenxuan Liu, He Li, Zongze Li, Shuai Wang, Wei Xu, Kejiang Ye, Derrick Wing Kwan Ng, Chengzhong Xu |
| 2025 | ISPEC | Zero-Recollecting Mobile-App Identification over Drifted Encrypted Network Traffic. | Minghao Jiang, Kejiang Ye, Wei Cai, Xu Zhou |
| 2025 | PAKDD | SDF-Guided Multi-modal Big Data Road Extraction. | Kun Feng, Juanjuan Zhao, Kejiang Ye, Xitong Gao |
| 2025 | PAKDD | Offline Map Matching Based on Localization Error Distribution Modeling. | Ruilin Xu, Yuchen Song, Kaijie Li, Xitong Gao, Kejiang Ye, Fan Zhang, Juanjuan Zhao |
| 2025 | PDCAT | TD3-Sched: Learning to Orchestrate Container-Based Cloud-Edge Resources via Distributed Reinforcement Learning. | Shengye Song, Minxian Xu, Kan Hu, Wenxia Guo, Kejiang Ye |
| 2024 | CSCWD | EINS: Edge-Cloud Deep Model Inference with Network-Efficiency Schedule in Serverless. | Shijie Peng, Yanying Lin, Wenyan Chen, Yingfei Tang, Xu Duan, Kejiang Ye |
| 2024 | ICA3PP | Resource Management for GPT-Based Model Deployed on Clouds: Challenges, Solutions, and Future Directions. | Yongkang Dang, Yiyuan He, Minxian Xu, Kejiang Ye |
| 2024 | ICDCS | QUART: Latency-Aware FaaS System for Pipelining Large Model Inference. | Yanying Lin, Yanbo Li, Shijie Peng, Yingfei Tang, Shutian Luo, Haiying Shen, Cheng-Zhong Xu, Kejiang Ye |
| 2024 | ICDCS | MLPing: Real-Time Proactive Fault Detection and Alarm for Large-Scale Distributed IDC Network. | Xian Yu, Kejiang Ye, Dongbiao He, Xianfan Chen, Chengzhong Xu, Jianhui Li, Gaogang Xie |
| 2024 | ICONIP | Improving Multilingual Speech Recognition with Tucker-Compressed Mixture of LoRAs. | Ye Hong, Guanghui Song, Xitong Gao, Tianhui Meng, Juanjuan Zhao, Kejiang Ye |
| 2024 | ICONIP | Tackling Periodic Distribution Shifts in Federated Learning with Half-Cycle Knowledge Distillation. | Xiangyu Pang, Dongping Liao, Xitong Gao, Juanjuan Zhao, Kejiang Ye |
| 2024 | ICPR | GCompletor: A Graph-Based Deep Learning Method for Traffic State Imputation on Urban Road Networks. | Kaijie Li, Juanjuan Zhao, Li Yan, Xitong Gao, Ye Li, Kejiang Ye |
| 2024 | ISCA | Derm: SLA-aware Resource Management for Highly Dynamic Microservices. | Liao Chen, Shutian Luo, Chenyu Lin, Zizhao Mo, Huanle Xu, Kejiang Ye, ChengZhong Xu |
| 2024 | ICSOC | UELLM: A Unified and Efficient Approach for Large Language Model Inference Serving. | Yiyuan He, Minxian Xu, Jingfeng Wu, Wanyi Zheng, Kejiang Ye, Cheng-Zhong Xu |
| 2024 | ICWS | Planck: Optimizing LLM Inference Performance in Pipeline Parallelism with Fine-Grained SLO Constraint. | Yanying Lin, Shijie Peng, Shuaipeng Wu, Yanbo Li, Chengzhi Lu, Chengzhong Xu, Kejiang Ye |
| 2024 | ISPA | MSARS: A Meta-Learning and Reinforcement Learning Framework for SLO Resource Allocation and Adaptive Scaling for Microservices. | Kan Hu, Linfeng Wen, Minxian Xu, Kejiang Ye |
| 2024 | PAKDD | MPRG: A Method for Parallel Road Generation Based on Trajectories of Multiple Types of Vehicles. | Bingru Han, Juanjuan Zhao, Xitong Gao, Kejiang Ye, Fan Zhang |
| 2024 | PAKDD | Enhanced HMM Map Matching Model Based on Multiple Type Trajectories. | Yuchen Song, Juanjuan Zhao, Xitong Gao, Fan Zhang, Kejiang Ye |
| 2024 | PAKDD | GSPM: An Early Detection Approach to Sudden Abnormal Large Outflow in a Metro System. | Li Sun, Juanjuan Zhao, Fan Zhang, Kejiang Ye |
| 2024 | PAKDD | FMSYS: Fine-Grained Passenger Flow Monitoring in a Large-Scale Metro System Based on AFC Smart Card Data. | Li Sun, Juanjuan Zhao, Fan Zhang, Rui Zhang, Kejiang Ye |
| 2024 | SC | SMIless: Serving DAG-based Inference with Dynamic Invocations under Serverless Computing. | Chengzhi Lu, Huanle Xu, Yudan Li, Wenyan Chen, Kejiang Ye, Chengzhong Xu |
| 2024 | TrustCom | A Multi-Stage Spike Stream Processing and Image Reconstruction Method for Industrial Applications. | Shuaipeng Wu, Changhao Yuan, Kejiang Ye |
| 2023 | ASPLOS | Erms: Efficient Resource Management for Shared Microservices with SLA Guarantees. | Shutian Luo, Huanle Xu, Kejiang Ye, Guoyao Xu, Liping Zhang, Jian He, Guodong Yang, Chengzhong Xu |
| 2023 | EuroSys | Understanding and Optimizing Workloads for Unified Resource Management in Large Cloud Platforms. | Chengzhi Lu, Huanle Xu, Kejiang Ye, Guoyao Xu, Liping Zhang, Guodong Yang, Chengzhong Xu |
| 2023 | ICANN | FeatEMD: Better Patch Sampling and Distance Metric for Few-Shot Image Classification. | Shisheng Deng, Dongping Liao, Xitong Gao, Juanjuan Zhao, Kejiang Ye |
| 2023 | ICCV | AdvDiffuser: Natural Adversarial Example Synthesis with Diffusion Models. | Xinquan Chen, Xitong Gao, Juanjuan Zhao, Kejiang Ye, Cheng-Zhong Xu |
| 2023 | ICPADS | FLASH: Low-Latency Serverless Model Inference with Multi-Core Parallelism in Edge. | Yanbo Li, Yanying Lin, Shijie Peng, Yingfei Tang, Tian Xiang, Wei Song, Kejiang Ye |
| 2023 | ICSOC | ChainsFormer: A Chain Latency-Aware Resource Provisioning Approach for Microservices Cluster. | Chenghao Song, Minxian Xu, Kejiang Ye, Huaming Wu, Sukhpal Singh Gill, Rajkumar Buyya, Cheng-Zhong Xu |
| 2023 | ICTAI | Destruction-Restoration Suppresses Data Protection Perturbations against Diffusion Models. | Tianrui Qin, Xitong Gao, Juanjuan Zhao, Kejiang Ye |
| 2023 | ISSTA | Detecting Vulnerabilities in Linux-Based Embedded Firmware with SSE-Based On-Demand Alias Analysis. | Kai Cheng, Yaowen Zheng, Tao Liu, Le Guan, Peng Liu, Hong Li, Hongsong Zhu, Kejiang Ye, Limin Sun |
| 2023 | SC | Interference-aware Multiplexing for Deep Learning in GPU Clusters: A Middleware Approach. | Wenyan Chen, Zizhao Mo, Huanle Xu, Kejiang Ye, Chengzhong Xu |
| 2022 | CLOUD | The power of prediction: microservice auto scaling via workload learning. | Shutian Luo, Huanle Xu, Kejiang Ye, Guoyao Xu, Liping Zhang, Guodong Yang, Chengzhong Xu |
| 2022 | HPCC | ESBench: Understanding Deep Learning Inference Overheads for Edge Serverless. | Yanying Lin, Junhong Chen, Yang Wang, Kejiang Ye |
| 2022 | ICPADS | GraphGRU: A Graph Neural Network Model for Resource Prediction in Microservice Cluster. | Hangtao He, Linyu Su, Kejiang Ye |
| 2022 | ISPA | System-level Implications of Serverless: Workload Characterizing and Performance Understanding. | Deshi Deng, Yanying Lin, Kejiang Ye |
| 2022 | UIC | DT-EEC: A Digital Twin-assisted End-Edge-Cloud Collaboration Architecture for Industrial Internet. | Lujie Tang, Kejiang Ye |
| 2021 | CLOUD | Characterizing Microservice Dependency and Performance: Alibaba Trace Analysis. | Shutian Luo, Huanle Xu, Chengzhi Lu, Kejiang Ye, Guoyao Xu, Liping Zhang, Yu Ding, Jian He, Chengzhong Xu |
| 2021 | CLUSTER | RPTCN: Resource Prediction for High-dynamic Workloads in Clouds based on Deep Learning. | Wenyan Chen, Chengzhi Lu, Kejiang Ye, Yang Wang, Cheng-Zhong Xu |
| 2021 | HPCC | PEAN: A Packet-level End-to-end Attentive Network for Encrypted Traffic Identification. | Peng Lin, Yishen Hu, Yanying Lin, Kejiang Ye, Cheng-Zhong Xu |
| 2020 | HPCC | HySync: Hybrid Federated Learning with Effective Synchronization. | Guomei Shi, Li Li, Jun Wang, Wenyan Chen, Kejiang Ye, Chengzhong Xu |
| 2020 | ICPADS | LBNN: Perceiving the State Changes of a Core Telecommunications Network via Linear Bayesian Neural Network. | Yanying Lin, Kejiang Ye, Ming Chen, Naitian Deng, Tailin Wu, Cheng-Zhong Xu |
| 2020 | ICPR | MA-LSTM: A Multi-Attention Based LSTM for Complex Pattern Extraction. | Jingjie Guo, Kelang Tian, Kejiang Ye, Cheng-Zhong Xu |
| 2020 | ICPR | Multi-Graph Convolutional Network for Relationship-Driven Stock Movement Prediction. | Jiexia Ye, Juanjuan Zhao, Kejiang Ye, Chengzhong Xu |
| 2020 | ICPR | AOAM: Automatic Optimization of Adjacency Matrix for Graph Convolutional Network. | Yuhang Zhang, Hongshuai Ren, Jiexia Ye, Xitong Gao, Yang Wang, Kejiang Ye, Cheng-Zhong Xu |
| 2020 | IJCNN | Multi-STGCnet: A Graph Convolution Based Spatial-Temporal Framework for Subway Passenger Flow Forecasting. | Jiexia Ye, Juanjuan Zhao, Kejiang Ye, Chengzhong Xu |
| 2020 | ICTAI | ST-MGAT: Spatial-Temporal Multi-Head Graph Attention Networks for Traffic Forecasting. | Kelang Tian, Jingjie Guo, Kejiang Ye, Cheng-Zhong Xu |
| 2019 | HPCC | Co-Locating Online Workload and Offline Workload in the Cloud: An Interference Analysis. | Wenyan Chen, Kejiang Ye, Cheng-Zhong Xu |
| 2019 | HPCC | Traffic Classification and Application Identification Based on Machine Learning in Large-Scale Supercomputing Center. | Shilin Zhao, Kejiang Ye, Cheng-Zhong Xu |
| 2019 | ICBC | Performance Benchmarking and Optimization for Blockchain Systems: A Survey. | Rui Wang, Kejiang Ye, Cheng-Zhong Xu |
| 2019 | ICPADS | DCSA: Using Density-Based Clustering and Sequential Association Analysis to Predict Alarms in Telecommunication Networks. | Peng Lin, Kejiang Ye, Ming Chen, Cheng-Zhong Xu |
| 2019 | ICPADS | ADGS: Anomaly Detection and Localization Based on Graph Similarity in Container-Based Clouds. | Chengzhi Lu, Kejiang Ye, Wenyan Chen, Cheng-Zhong Xu |
| 2019 | NPC | DAFL: Deep Adaptive Feature Learning for Network Anomaly Detection. | Shujian Ji, Tongzheng Sun, Kejiang Ye, Wenbo Wang, Cheng-Zhong Xu |
| 2019 | NPC | BTS: Balanced Task Scheduling Strategy Based on Multi-resource Prediction and Allocation in Cloud Environment. | Yongzhong Sun, Kejiang Ye, Wenbo Wang, Cheng-Zhong Xu |
| 2018 | CLUSTER | Reducing Tail Latency of Interactive Multi-tier Workloads in the Cloud. | Kejiang Ye, Cheng-Zhong Xu |
| 2018 | ICPADS | How Does the Workload Look Like in Production Cloud? Analysis and Clustering of Workloads on Alibaba Cluster Trace. | Wenyan Chen, Kejiang Ye, Yang Wang, Guoyao Xu, Cheng-Zhong Xu |
| 2018 | ICPADS | Modeling Application Performance in Docker Containers Using Machine Learning Techniques. | Kejiang Ye, Yanmin Kou, Chengzhi Lu, Yang Wang, Cheng-Zhong Xu |
| 2018 | NPC | A Deep Learning Approach for Network Anomaly Detection Based on AMF-LSTM. | Mingyi Zhu, Kejiang Ye, Yang Wang, Cheng-Zhong Xu |
| 2017 | ASPLOS | Anomaly Detection in Clouds: Challenges and Practice. | Kejiang Ye |
| 2016 | ICDCS | Virtual Machine Level Temperature Profiling and Prediction in Cloud Datacenters. | Zhaohui Wu, Xiang Li, Peter Garraghan, Xiaohong Jiang, Kejiang Ye, Albert Y. Zomaya |
| 2012 | CLUSTER | vHadoop: A Scalable Hadoop Virtual Cluster Platform for MapReduce-Based Parallel Machine Learning with Performance Consideration. | Kejiang Ye, Xiaohong Jiang, Yanzhang He, Xiang Li, Haiming Yan, Peng Huang |
| 2011 | CLUSTER | An Energy-Efficient Scheme for Cloud Resource Provisioning Based on CloudSim. | Yuxiang Shi, Xiaohong Jiang, Kejiang Ye |
| 2011 | NPC | Informed Live Migration Strategies of Virtual Machines for Cluster Load Balancing. | Xing Li, Qinming He, Jianhai Chen, Kejiang Ye, Ting Yin |
| 2010 | HPCC | Analyzing and Modeling the Performance in Xen-Based Virtual Cluster Environment. | Kejiang Ye, Xiaohong Jiang, Siding Chen, Dawei Huang, Bei Wang |
| 2010 | HPCC | Two Optimization Mechanisms to Improve the Isolation Property of Server Consolidation in Virtualized Multi-core Server. | Kejiang Ye, Xiaohong Jiang, Deshi Ye, Dawei Huang |
| 2010 | NPC | Evaluate the Performance and Scalability of Image Deployment in Virtual Data Center. | Kejiang Ye, Xiaohong Jiang, Qinming He, Xing Li, Jianhai Chen |