Hairui Zhao
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
12
Venues
8
Active years
2023–2026
Best venue rank
A*
Where they publish
Papers
12 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | HPDC | TACO: Efficient Communication Compression of Intermediate Tensors for Scalable Tensor-Parallel LLM Training. | Man Liu, Xingchen Liu, Xingjian Tian, Bing Lu, Shengkai Lyu, Shengquan Yin, Wenjing Huang, Zheng Wei, Hairui Zhao, Guangming Tan, Dingwen Tao |
| 2026 | HPDC | A Fully GPU-Accelerated Framework for High-Performance Configuration Interaction Selection with Neural Network Quantum States. | Daran Sun, Bowen Kan, Haoquan Long, Hairui Zhao, Haoxu Li, Yicheng Liu, Pengyu Zhou, Ankang Feng, Wenjing Huang, Yida Gu, Zhenyu Li, Honghui Shang, Yunquan Zhang, Dingwen Tao, Ninghui Sun, Guangming Tan |
| 2026 | INFOCOM | Rehabilitating over Recomputing: A Novel Failure Recovery Method for Large Model Training. | Zichen Wang, Hongliang Li, Jie Wu, Zhewen Xu, Hairui Zhao, Qi Tian, Haixiao Xu |
| 2026 | ISCA | ENEC: A Lossless AI Model Compression Method Enabling Fast Inference on Ascend NPUs. | Jinwu Yang, Jiaan Wu, Zedong Liu, Xinyang Ma, Hairui Zhao, Yida Gu, Yuanhong Huang, Xingchen Liu, Wenjing Huang, Zheng Wei, Jing Xing, Yili Ma, Qingyi Zhang, Baoyi An, Zhongzhe Hu, Shaoteng Liu, Xia Zhu, Jiaxun Lu, Guangming Tan, Dingwen Tao |
| 2026 | PPoPP | PRISM: An Efficient GPU-Based Lossy Compression Framework for Progressive Data Retrieval with Multi-Level Interpolation. | Bing Lu, Zedong Liu, Hairui Zhao, Dejun Luo, Wenjing Huang, Yida Gu, Jinyang Liu, Guangming Tan, Dingwen Tao |
| 2026 | PPoPP | CCL-D: A High-Precision Diagnostic System for Slow and Hang Anomalies in Large-Scale Model Training. | Yida Gu, Fakang Wang, Jianhao Fu, Zhenhang Sun, Qianyu Zhang, Hairui Zhao, Xingchen Liu, Yang Tian, Wenjing Huang, Zedong Liu, Yifan Chen, Jinwu Yang, Yueyuan Zhou, Qian Zhao, Haoxu Li, Tao Wang, Feng Yu, Zhan Wang, Guangming Tan, Dingwen Tao |
| 2026 | PPoPP | COCCL: A Collective Communication Library Supporting Easy Integration and Configuration of Customized Compression for Scalable LLM Training. | Xingchen Liu, Haoran Kong, Hairui Zhao, Shengkai Lyu, Zheng Wei, Man Liu, Xingjian Tian, Liyang Zhao, Zhuohan Chen, Fakang Wang, Zizhong Chen, Zhan Wang, Guangming Tan, Dingwen Tao |
| 2026 | SIGCOMM | KVServe: Service-Aware KV Cache Compression for Communication-Efficient Disaggregated LLM Serving. | Zedong Liu, Xinyang Ma, Dejun Luo, Hairui Zhao, Bing Lu, Wenjing Huang, Yida Gu, Xingchen Liu, Zheng Wei, Jinyang Liu, Dingwen Tao, Guangming Tan |
| 2025 | INFOCOM | ArrayPipe: Introducing Job-Array Pipeline Parallelism for High Throughput Model Exploration. | Hairui Zhao, Hongliang Li, Qi Tian, Jie Wu, Meng Zhang, Zhewen Xu, Xiang Li, Haixiao Xu |
| 2025 | USENIX | FlexPipe: Maximizing Training Efficiency for Transformer-based Models with Variable-Length Inputs. | Hairui Zhao, Qi Tian, Hongliang Li, Zizhong Chen |
| 2024 | IJCNN | EFNAS: Efficient Federated Neural Architecture Search Across AIoT Devices. | Xiaohui Wei, Guanhua Chen, Chen Yang, Hairui Zhao, Chenyang Wang, Hengshan Yue |
| 2023 | CLUSTER | ExplSched: Maximizing Deep Learning Cluster Efficiency for Exploratory Jobs. | Hongliang Li, Hairui Zhao, Zhewen Xu, Xiang Li, Haixiao Xu |