| 2025 | ASPLOS | Frugal: Efficient and Economic Embedding Model Training with Commodity GPUs. | Minhui Xie, Shaoxun Zeng, Hao Guo, Shiwei Gao, Youyou Lu |
| 2025 | ASPLOS | Medusa: Accelerating Serverless LLM Inference with Materialization. | Shaoxun Zeng, Minhui Xie, Shiwei Gao, Youmin Chen, Youyou Lu |
| 2025 | SDM | Hierarchical Superpixel Segmentation via Structural Information Theory. | Minhui Xie, Hao Peng, Pu Li, Guangjie Zeng, Shuhai Wang, Jia Wu, Peng Li, Philip S. Yu |
| 2025 | USENIX | GPREEMPT: GPU Preemptive Scheduling Made General and Efficient. | Ruwen Fan, Tingxu Ren, Minhui Xie, Shiwei Gao, Jiwu Shu, Youyou Lu |
| 2025 | USENIX | Turbocharge ANNS on Real Processing-in-Memory by Enabling Fine-Grained Per-PIM-Core Scheduling. | Puqing Wu, Minhui Xie, Enrui Zhao, Dafang Zhang, Jing Wang, Xiao Liang, Kai Ren, Yunpeng Chai |
| 2024 | ASPLOS | MaxEmbed: Maximizing SSD bandwidth utilization for huge embedding models serving. | Ruwen Fan, Minhui Xie, Haodi Jiang, Youyou Lu |
| 2023 | ASPLOS | Mobius: Fine Tuning Large-Scale Models on Commodity GPU Servers. | Yangyang Feng, Minhui Xie, Zijie Tian, Shuo Wang, Youyou Lu, Jiwu Shu |
| 2023 | FAST | Citron: Distributed Range Lock Management with One-sided RDMA. | Jian Gao, Youyou Lu, Minhui Xie, Qing Wang, Jiwu Shu |
| 2023 | FAST | Patronus: High-Performance and Protective Remote Memory. | Bin Yan, Youyou Lu, Qing Wang, Minhui Xie, Jiwu Shu |
| 2022 | EuroSys | Fleche: an efficient GPU embedding cache for personalized recommendations. | Minhui Xie, Youyou Lu, Jiazhen Lin, Qing Wang, Jian Gao, Kai Ren, Jiwu Shu |
| 2022 | USENIX | Pacman: An Efficient Compaction Approach for Log-Structured Key-Value Store on Persistent Memory. | Jing Wang, Youyou Lu, Qing Wang, Minhui Xie, Keji Huang, Jiwu Shu |
| 2020 | SC | Kraken: memory-efficient continual learning for large-scale real-time recommendations. | Minhui Xie, Kai Ren, Youyou Lu, Guangxu Yang, Qingxing Xu, Bihai Wu, Jiazhen Lin, Hongbo Ao, Wanhong Xu, Jiwu Shu |