| 2026 | ASPLOS | ZipServ: Fast and Memory-Efficient LLM Inference with Hardware-Aware Lossless Compression. | Ruibo Fan, Xiangrui Yu, Xinglin Pan, Zeyu Li, Weile Luo, Qiang Wang, Wei Wang, Xiaowen Chu |
| 2026 | ICS | DynSpAttn: Efficient Attention via Dual-Side Dynamic Sparsity on Sparse Tensor Cores. | Xiangrui Yu, Ruibo Fan, Zeyu Li, Weile Luo, Gu Gong, Xiaowen Chu |
| 2026 | PPoPP | ROME: Maximizing GPU Efficiency for All-Pairs Shortest Path via Taming Fine-Grained Irregularities. | Weile Luo, Yuhan Chen, Xiangrui Yu, Qiang Wang, Ruibo Fan, Hongyuan Liu, Xiaowen Chu |
| 2026 | SIGCOMM | ZipCCL: Efficient Lossless Data Compression of Communication Collectives for Accelerating LLM Training. | Wenxiang Lin, Xinglin Pan, Ruibo Fan, Shaohuai Shi, Xiaowen Chu |
| 2025 | EuroSys | SpInfer: Leveraging Low-Level Sparsity for Efficient Large Language Model Inference on GPUs. | Ruibo Fan, Xiangrui Yu, Peijie Dong, Zeyu Li, Gu Gong, Qiang Wang, Wei Wang, Xiaowen Chu |
| 2025 | ICLR | STBLLM: Breaking the 1-Bit Barrier with Structured Binary LLMs. | Peijie Dong, Lujun Li, Yuedong Zhong, Dayou Du, Ruibo Fan, Yuhan Chen, Zhenheng Tang, Qiang Wang, Wei Xue, Yike Guo, Xiaowen Chu |
| 2024 | ASPLOS | DTC-SpMM: Bridging the Gap in Accelerating General Sparse Matrix Multiplication with Tensor Cores. | Ruibo Fan, Wei Wang, Xiaowen Chu |