Skip to content

Shuibing He

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

36

Venues

19

Active years

2013–2026

Best venue rank

A*

Where they publish

Papers

36 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLSpiderFlow: Efficient Topology-Aware Scheduling for LLM Training Across Decentralized GPU Clusters.Zihan Chang, Shuibing He, Bo Zhou, Sheng Xiao, Siling Yang, Rui Wang, Zhe Pan
2026EuroParFrenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters.Zihan Chang, Sheng Xiao, Shuibing He, Xuechen Zhang, Siling Yang, Zhenxin Li, Zhe Pan, Weijian Chen
2025FASTLeapGNN: Accelerating Distributed GNN Training Leveraging Feature-Centric Model Migration.Weijian Chen, Shuibing He, Haoyang Qu, Xuechen Zhang
2025FASTIMPRESS: An Importance-Informed Multi-Tier Prefix KV Storage System for Large Language Model Inference.Weijian Chen, Shuibing He, Haoyang Qu, Ruidong Zhang, Siling Yang, Ping Chen, Yi Zheng, Baoxing Huai, Gang Chen
2025HPCAGoPIM: GCN-Oriented Pipeline Optimization for PIM Accelerators.Siling Yang, Shuibing He, Wenjiong Wang, Yanlong Yin, Tong Wu, Weijian Chen, Xuechen Zhang, Xian-He Sun, Dan Feng
2025ICPADSAn Efficient Server-Side Prefetching Scheme to Optimize Performance of Distribution File Systems.Yong Li, Shuibing He, Qian Zhao, Zhan Shi, Yi Qin, Weixu Zong, Peng Xu, Lingfang Zeng
2024CLUSTERFTGraph: A Flexible Tree-Based Graph Store on Persistent Memory for Large-Scale Dynamic Graphs.Gan Sun, Jiang Zhou, Bo Li, Xiaoyan Gu, Weiping Wang, Shuibing He
2024EuroSysCCL-BTree: A Crash-Consistent Locality-Aware B+-Tree for Reducing XPBuffer-Induced Write Amplification in Persistent Memory.Zhenxin Li, Shuibing He, Zheng Dang, Peiyi Hong, Xuechen Zhang, Rui Wang, Fei Wu
2024ICPPAUTOHET: An Automated Heterogeneous ReRAM-Based Accelerator for DNN Inference.Tong Wu, Shuibing He, Jianxin Zhu, Weijian Chen, Siling Yang, Ping Chen, Yanlong Yin, Xuechen Zhang, Xian-He Sun, Gang Chen
2024SCEnumeration of Billions of Maximal Bicliques in Bipartite Graphs without Using GPUs.Zhe Pan, Shuibing He, Xu Li, Xuechen Zhang, Yanlong Yin, Rui Wang, Lidan Shou, Mingli Song, Xian-He Sun, Gang Chen
2024USENIXEfficient Large Graph Processing with Chunk-Based Graph Representation Model.Rui Wang, Weixu Zong, Shuibing He, Xinyu Chen, Zhenxin Li, Zheng Dang
2023ASPLOSMapping Very Large Scale Spiking Neuron Network to Neuromorphic Hardware.Ouwen Jin, Qinghui Xing, Ying Li, Shuiguang Deng, Shuibing He, Gang Pan
2023HPCAiCache: An Importance-Sampling-Informed Cache for Accelerating I/O-Bound DNN Model Training.Weijian Chen, Shuibing He, Yaowen Xu, Xuechen Zhang, Siling Yang, Shuang Hu, Xian-He Sun, Gang Chen
2023HPCABM-Store: A Transparent and High-performance Local Storage Architecture for Bare-metal Clouds Enabling Large-scale Deployment.Yiquan Chen, Jiexiong Xu, Chengkun Wei, Yijing Wang, Xin Yuan, Yangming Zhang, Xulin Yu, Yi Chen, Zeke Wang, Shuibing He, Wenzhi Chen
2023SCEfficient Maximal Biclique Enumeration on GPUs.Zhe Pan, Shuibing He, Xu Li, Xuechen Zhang, Rui Wang, Gang Chen
2022ASPLOSNVAlloc: rethinking heap metadata management in persistent memory allocators.Zheng Dang, Shuibing He, Peiyi Hong, Zhenxin Li, Xuechen Zhang, Xian-He Sun, Gang Chen
2022MICROXPGraph: XPline-Friendly Persistent Memory Graph Stores for Large-Scale Evolving Graphs.Rui Wang, Shuibing He, Weixu Zong, Yongkun Li, Yinlong Xu
2021CLUSTERCSWAP: A Self-Tuning Compression Framework for Accelerating Tensor Swapping in GPUs.Ping Chen, Shuibing He, Xuechen Zhang, Shuaiben Chen, Peiyi Hong, Yanlong Yin, Xian-He Sun, Gang Chen
2021ICPPA Novel Multi-CPU/GPU Collaborative Computing Framework for SGD-based Matrix Factorization.Yizhi Huang, Yanlong Yin, Yan Liu, Shuibing He, Yang Bai, Renfa Li
2021ICSAUTO-PRUNE: automated DNN pruning and mapping for ReRAM-based accelerator.Siling Yang, Weijian Chen, Xuechen Zhang, Shuibing He, Yanlong Yin, Xian-He Sun
2020ICSCompiler aided checkpointing using crash-consistent data structures in NVMM systems.Tyler Coy, Shuibing He, Bin Ren, Xuechen Zhang
2020VTCBudget Feasible Roadside Unit Allocation Mechanism in Vehicular Ad-Hoc Networks.Xiaohua Xu, Shuibing He, Meng Han, Reza M. Parizi, Gautam Srivastava
2019CLUSTERDP_Greedy: A Two-Phase Caching Algorithm for Mobile Cloud Services.Dong Huang, Xiaopeng Fan, Yang Wang, Shuibing He, Cheng-Zhong Xu
2019ICPPOn Integration of Appends and Merges in Log-Structured Merge Trees.Caixin Gong, Shuibing He, Yili Gong, Yingchun Lei
2018NPCKT-Store: A Key-Order and Write-Order Hybrid Key-Value Store with High Write and Range-Query Performance.Haobo Wang, Yinliang Yue, Shuibing He, Weiping Wang
2017ICPPData Caching in Next Generation Mobile Cloud Services, Online vs. Off-Line.Yang Wang, Shuibing He, Xiaopeng Fan, Chengzhong Xu, Joseph C. Culberson, Joseph Horton
2017ISPAMCS-B: An Energy Efficient Storage System for Astronomical Observation Data Based on Logical Block Replacement Strategy.Chao Sun, Shanjiang Tang, Zichao Yuan, Ce Yu, Jian Xiao, Jizhou Sun, Shuibing He
2016ICDCSOn MinMax-Memory Claims for Scientific Workflows in the In-memory Cloud Computing.Yang Wang, Cheng-Zhong Xu, Shuibing He, Xian-He Sun
2016ICPADSOn Autonomous Service Migrations in the Cloud for Mobile Accesses.Yang Wang, Shuibing He, Fuji Ren, Lujia Wang, Cheng-Zhong Xu
2015HiPCIC-Data: Improving Compressed Data Processing in Hadoop.Adnan Haider, Xi Yang, Ning Liu, Xian-He Sun, Shuibing He
2015ICPPA Heterogeneity-Aware Region-Level Data Layout for Hybrid Parallel File Systems.Shuibing He, Xian-He Sun, Yang Wang, Antonis Kougkas, Adnan Haider
2014ICA3PPPerformance-Aware Data Placement in Hybrid Parallel File Systems.Shuibing He, Xian-He Sun, Bo Feng, Kun Feng
2014ICDCSS4D-Cache: Smart Selective SSD Cache for Parallel I/O Systems.Shuibing He, Xian-He Sun, Bo Feng
2014SCHPIS3: towards a high-performance simulator for hybrid parallel I/O and storage systems.Bo Feng, Ning Liu, Shuibing He, Xian-He Sun
2014SCPSA: a performance and space-aware data layout scheme for hybrid parallel file systems.Shuibing He, Yan Liu, Xian-He Sun
2013CLUSTERA cost-aware region-level data placement scheme for hybrid parallel I/O systems.Shuibing He, Xian-He Sun, Bo Feng, Xin Huang, Kun Feng