| 2026 | ACL | SpiderFlow: Efficient Topology-Aware Scheduling for LLM Training Across Decentralized GPU Clusters. | Zihan Chang, Shuibing He, Bo Zhou, Sheng Xiao, Siling Yang, Rui Wang, Zhe Pan |
| 2026 | EuroPar | Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters. | Zihan Chang, Sheng Xiao, Shuibing He, Xuechen Zhang, Siling Yang, Zhenxin Li, Zhe Pan, Weijian Chen |
| 2025 | FAST | LeapGNN: Accelerating Distributed GNN Training Leveraging Feature-Centric Model Migration. | Weijian Chen, Shuibing He, Haoyang Qu, Xuechen Zhang |
| 2025 | FAST | IMPRESS: An Importance-Informed Multi-Tier Prefix KV Storage System for Large Language Model Inference. | Weijian Chen, Shuibing He, Haoyang Qu, Ruidong Zhang, Siling Yang, Ping Chen, Yi Zheng, Baoxing Huai, Gang Chen |
| 2025 | HPCA | GoPIM: GCN-Oriented Pipeline Optimization for PIM Accelerators. | Siling Yang, Shuibing He, Wenjiong Wang, Yanlong Yin, Tong Wu, Weijian Chen, Xuechen Zhang, Xian-He Sun, Dan Feng |
| 2025 | ICPADS | An Efficient Server-Side Prefetching Scheme to Optimize Performance of Distribution File Systems. | Yong Li, Shuibing He, Qian Zhao, Zhan Shi, Yi Qin, Weixu Zong, Peng Xu, Lingfang Zeng |
| 2024 | CLUSTER | FTGraph: A Flexible Tree-Based Graph Store on Persistent Memory for Large-Scale Dynamic Graphs. | Gan Sun, Jiang Zhou, Bo Li, Xiaoyan Gu, Weiping Wang, Shuibing He |
| 2024 | EuroSys | CCL-BTree: A Crash-Consistent Locality-Aware B+-Tree for Reducing XPBuffer-Induced Write Amplification in Persistent Memory. | Zhenxin Li, Shuibing He, Zheng Dang, Peiyi Hong, Xuechen Zhang, Rui Wang, Fei Wu |
| 2024 | ICPP | AUTOHET: An Automated Heterogeneous ReRAM-Based Accelerator for DNN Inference. | Tong Wu, Shuibing He, Jianxin Zhu, Weijian Chen, Siling Yang, Ping Chen, Yanlong Yin, Xuechen Zhang, Xian-He Sun, Gang Chen |
| 2024 | SC | Enumeration of Billions of Maximal Bicliques in Bipartite Graphs without Using GPUs. | Zhe Pan, Shuibing He, Xu Li, Xuechen Zhang, Yanlong Yin, Rui Wang, Lidan Shou, Mingli Song, Xian-He Sun, Gang Chen |
| 2024 | USENIX | Efficient Large Graph Processing with Chunk-Based Graph Representation Model. | Rui Wang, Weixu Zong, Shuibing He, Xinyu Chen, Zhenxin Li, Zheng Dang |
| 2023 | ASPLOS | Mapping Very Large Scale Spiking Neuron Network to Neuromorphic Hardware. | Ouwen Jin, Qinghui Xing, Ying Li, Shuiguang Deng, Shuibing He, Gang Pan |
| 2023 | HPCA | iCache: An Importance-Sampling-Informed Cache for Accelerating I/O-Bound DNN Model Training. | Weijian Chen, Shuibing He, Yaowen Xu, Xuechen Zhang, Siling Yang, Shuang Hu, Xian-He Sun, Gang Chen |
| 2023 | HPCA | BM-Store: A Transparent and High-performance Local Storage Architecture for Bare-metal Clouds Enabling Large-scale Deployment. | Yiquan Chen, Jiexiong Xu, Chengkun Wei, Yijing Wang, Xin Yuan, Yangming Zhang, Xulin Yu, Yi Chen, Zeke Wang, Shuibing He, Wenzhi Chen |
| 2023 | SC | Efficient Maximal Biclique Enumeration on GPUs. | Zhe Pan, Shuibing He, Xu Li, Xuechen Zhang, Rui Wang, Gang Chen |
| 2022 | ASPLOS | NVAlloc: rethinking heap metadata management in persistent memory allocators. | Zheng Dang, Shuibing He, Peiyi Hong, Zhenxin Li, Xuechen Zhang, Xian-He Sun, Gang Chen |
| 2022 | MICRO | XPGraph: XPline-Friendly Persistent Memory Graph Stores for Large-Scale Evolving Graphs. | Rui Wang, Shuibing He, Weixu Zong, Yongkun Li, Yinlong Xu |
| 2021 | CLUSTER | CSWAP: A Self-Tuning Compression Framework for Accelerating Tensor Swapping in GPUs. | Ping Chen, Shuibing He, Xuechen Zhang, Shuaiben Chen, Peiyi Hong, Yanlong Yin, Xian-He Sun, Gang Chen |
| 2021 | ICPP | A Novel Multi-CPU/GPU Collaborative Computing Framework for SGD-based Matrix Factorization. | Yizhi Huang, Yanlong Yin, Yan Liu, Shuibing He, Yang Bai, Renfa Li |
| 2021 | ICS | AUTO-PRUNE: automated DNN pruning and mapping for ReRAM-based accelerator. | Siling Yang, Weijian Chen, Xuechen Zhang, Shuibing He, Yanlong Yin, Xian-He Sun |
| 2020 | ICS | Compiler aided checkpointing using crash-consistent data structures in NVMM systems. | Tyler Coy, Shuibing He, Bin Ren, Xuechen Zhang |
| 2020 | VTC | Budget Feasible Roadside Unit Allocation Mechanism in Vehicular Ad-Hoc Networks. | Xiaohua Xu, Shuibing He, Meng Han, Reza M. Parizi, Gautam Srivastava |
| 2019 | CLUSTER | DP_Greedy: A Two-Phase Caching Algorithm for Mobile Cloud Services. | Dong Huang, Xiaopeng Fan, Yang Wang, Shuibing He, Cheng-Zhong Xu |
| 2019 | ICPP | On Integration of Appends and Merges in Log-Structured Merge Trees. | Caixin Gong, Shuibing He, Yili Gong, Yingchun Lei |
| 2018 | NPC | KT-Store: A Key-Order and Write-Order Hybrid Key-Value Store with High Write and Range-Query Performance. | Haobo Wang, Yinliang Yue, Shuibing He, Weiping Wang |
| 2017 | ICPP | Data Caching in Next Generation Mobile Cloud Services, Online vs. Off-Line. | Yang Wang, Shuibing He, Xiaopeng Fan, Chengzhong Xu, Joseph C. Culberson, Joseph Horton |
| 2017 | ISPA | MCS-B: An Energy Efficient Storage System for Astronomical Observation Data Based on Logical Block Replacement Strategy. | Chao Sun, Shanjiang Tang, Zichao Yuan, Ce Yu, Jian Xiao, Jizhou Sun, Shuibing He |
| 2016 | ICDCS | On MinMax-Memory Claims for Scientific Workflows in the In-memory Cloud Computing. | Yang Wang, Cheng-Zhong Xu, Shuibing He, Xian-He Sun |
| 2016 | ICPADS | On Autonomous Service Migrations in the Cloud for Mobile Accesses. | Yang Wang, Shuibing He, Fuji Ren, Lujia Wang, Cheng-Zhong Xu |
| 2015 | HiPC | IC-Data: Improving Compressed Data Processing in Hadoop. | Adnan Haider, Xi Yang, Ning Liu, Xian-He Sun, Shuibing He |
| 2015 | ICPP | A Heterogeneity-Aware Region-Level Data Layout for Hybrid Parallel File Systems. | Shuibing He, Xian-He Sun, Yang Wang, Antonis Kougkas, Adnan Haider |
| 2014 | ICA3PP | Performance-Aware Data Placement in Hybrid Parallel File Systems. | Shuibing He, Xian-He Sun, Bo Feng, Kun Feng |
| 2014 | ICDCS | S4D-Cache: Smart Selective SSD Cache for Parallel I/O Systems. | Shuibing He, Xian-He Sun, Bo Feng |
| 2014 | SC | HPIS3: towards a high-performance simulator for hybrid parallel I/O and storage systems. | Bo Feng, Ning Liu, Shuibing He, Xian-He Sun |
| 2014 | SC | PSA: a performance and space-aware data layout scheme for hybrid parallel file systems. | Shuibing He, Yan Liu, Xian-He Sun |
| 2013 | CLUSTER | A cost-aware region-level data placement scheme for hybrid parallel I/O systems. | Shuibing He, Xian-He Sun, Bo Feng, Xin Huang, Kun Feng |