Yitao Hu
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
18
Venues
11
Active years
2014–2026
Best venue rank
A*
Where they publish
Papers
18 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ASPLOS | PAT: Accelerating LLM Decoding via Prefix-Aware Attention with Resource Efficient Multi-Tile Kernel. | Jinjun Yi, Zhixin Zhao, Yitao Hu, Ke Yan, Weiwei Sun, Hao Wang, Laiping Zhao, Yuhao Zhang, Wenxin Li, Keqiu Li |
| 2026 | EuroSys | PARD: Enhancing Goodput for Inference Pipeline via Proactive Request Dropping. | Zhixin Zhao, Yitao Hu, Simin Chen, Mingfang Ji, Wei Yang, Yuhao Zhang, Laiping Zhao, Wenxin Li, Xiulong Liu, Wenyu Qu, Hao Wang |
| 2025 | HPCC | SmartCache: Two-Dimensional KV-Cache Similarity for Efficient Long-Context LLM Decoding. | Chen Shen, Hao Chen, Kaining Hui, Zhixin Zhao, Yang Cheng, Yitao Hu, Sheng Chen, Xiulong Liu, Keqiu Li |
| 2025 | HPCC | SuperSpec: Enhanced Verification and Sampling for End-to-End LLM Speculative Decoding. | Chen Shen, Rui Guo, Yang Cheng, Yang Lin, Zhixin Zhao, Yitao Hu, Sheng Chen, Xiulong Liu, Keqiu Li |
| 2025 | ICPADS | MoEoM: Joint Compute and Memory-Aware Balancing for Fast MoE Inference. | Ziqi Gong, Yitao Hu, Sheng Chen, Wenxin Li, Keqiu Li |
| 2025 | INFOCOM | Lark: A Buffer-aware Building Block for Programmable Packet Scheduling in Datacenters. | Song Zhang, Wenxin Li, Yulong Li, Yuan Liu, Lide Suo, Sheng Chen, Yitao Hu, Laiping Zhao, Keqiu Li |
| 2025 | INFOCOM | Harpagon: Minimizing DNN Serving Cost via Efficient Dispatching, Scheduling and Splitting. | Zhixin Zhao, Yitao Hu, Ziqi Gong, Guotao Yang, Wenxin Li, Xiulong Liu, Keqiu Li, Hao Wang |
| 2024 | ASPLOS | FUYAO: DPU-enabled Direct Data Transfer for Serverless Computing. | Guowei Liu, Laiping Zhao, Yiming Li, Zhaolin Duan, Sheng Chen, Yitao Hu, Zhiyuan Su, Wenyu Qu |
| 2024 | CLOUD | Pre-Warming is Not Enough: Accelerating Serverless Inference With Opportunistic Pre-Loading. | Yifan Sui, Hanfei Yu, Yitao Hu, Jianxun Li, Hao Wang |
| 2024 | HPCC | WQEFC: A Scalable and Low-Latency RDMA Messages Scheduler for Mixed Messages. | Yaozhen Li, Yuxuan Du, Lide Suo, Xiancheng Meng, Yiren Pang, Wenxin Li, Keqiu Li, Yitao Hu |
| 2024 | HPCC | Efficient Disaggregated Memory Eviction with Glitter. | Linxuan Zhong, Wenxin Li, Yulong Li, Jiawen Shen, Song Zhang, Wenyu Qu, Yitao Hu |
| 2024 | SIGCOMM | PPT: A Pragmatic Transport for Datacenters. | Lide Suo, Yiren Pang, Wenxin Li, Renjie Pei, Keqiu Li, Xiulong Liu, Xin He, Yitao Hu, Guyue Liu |
| 2023 | ICA3PP | DeepLat: Achieving Minimum Worst Case Latency for DNN Inference with Batch-Aware Dispatching. | Jiaheng Gao, Yitao Hu |
| 2023 | IWQoS | High-throughput Sampling, Communicating and Training for Reinforcement Learning Systems. | Laiping Zhao, Xinan Dai, Zhixin Zhao, Yusong Xin, Yitao Hu, Jun Qian, Jun Yao, Keqiu Li |
| 2021 | CLOUD | Scrooge: A Cost-Effective Deep Learning Inference System. | Yitao Hu, Rajrup Ghosh, Ramesh Govindan |
| 2018 | Middleware | Olympian: Scheduling GPU Usage in a Deep Neural Network Model Serving System. | Yitao Hu, Swati Rallapalli, Bongjun Ko, Ramesh Govindan |
| 2015 | RTSS | Data Acquisition for Real-Time Decision-Making under Freshness Constraints. | Shaohan Hu, Shuochao Yao, Haiming Jin, Yiran Zhao, Yitao Hu, Xiaochen Liu, Nooreddin Naghibolhosseini, Shen Li, Akash Kapoor, William Dron, Lu Su, Amotz Bar-Noy, Pedro A. Szekely, Ramesh Govindan, Reginald L. Hobbs, Tarek F. Abdelzaher |
| 2014 | INFOCOM | Critical sensing range for mobile heterogeneous camera sensor networks. | Yitao Hu, Xinbing Wang, Xiaoying Gan |