Skip to content

Zizhong Chen

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

78

Venues

20

Active years

2003–2026

Best venue rank

A*

Where they publish

Papers

78 indexed papers, newest first.

YearVenueTitleAuthors
2026PPoPPCOCCL: A Collective Communication Library Supporting Easy Integration and Configuration of Customized Compression for Scalable LLM Training.Xingchen Liu, Haoran Kong, Hairui Zhao, Shengkai Lyu, Zheng Wei, Man Liu, Xingjian Tian, Liyang Zhao, Zhuohan Chen, Fakang Wang, Zizhong Chen, Zhan Wang, Guangming Tan, Dingwen Tao
2025ICSghZCCL: Advancing GPU-aware Collective Communications with Homomorphic Compression.Jiajun Huang, Sheng Di, Yafan Huang, Zizhong Chen, Franck Cappello, Yanfei Guo, Rajeev Thakur
2025PPoPPTurboFFT: Co-Designed High-Performance and Fault-Tolerant Fast Fourier Transform on GPUs.Shixun Wu, Yujia Zhai, Jinyang Liu, Jiajun Huang, Zizhe Jian, Huangliang Dai, Sheng Di, Franck Cappello, Zizhong Chen
2025SCFT-Transformer: Resilient and Reliable Transformer with End-to-End Fault Tolerant Attention.Huangliang Dai, Shixun Wu, Jiajun Huang, Zizhe Jian, Yue Zhu, Haiyang Hu, Zizhong Chen
2025SCLightweight CNN-Based Artifact Reduction for Scientific Error-bounded Lossy Compression.Zizhe Jian, Pu Jiao, Bohan Zhang, Sheng Di, Xin Liang, Guanpeng Li, Huangliang Dai, Zizhong Chen, Franck Cappello
2025SCBoosting Scientific Error-Bounded Lossy Compression through Optimized Synergistic Lossy-Lossless Orchestration.Shixun Wu, Jinwen Pan, Jinyang Liu, Jiannan Tian, Ziwei Qiu, Jiajun Huang, Kai Zhao, Xin Liang, Sheng Di, Zizhong Chen, Franck Cappello
2025SCTurboFNO: High-Performance Fourier Neural Operator with Fused FFT-GEMM-iFFT on GPU.Shixun Wu, Yujia Zhai, Huangliang Dai, Yue Zhu, Haiyang Hu, Zizhong Chen
2025USENIXFlexPipe: Maximizing Training Efficiency for Transformer-based Models with Variable-Length Inputs.Hairui Zhao, Qi Tian, Hongliang Li, Zizhong Chen
2024CLUSTERFT K-Means: A High-Performance K-Means on GPU with Fault Tolerance.Shixun Wu, Yitong Ding, Yujia Zhai, Jinyang Liu, Jiajun Huang, Zizhe Jian, Huangliang Dai, Sheng Di, Bryan M. Wong, Zizhong Chen, Franck Cappello
2024ICSgZCCL: Compression-Accelerated Collective Communication Framework for GPU Clusters.Jiajun Huang, Sheng Di, Xiaodong Yu, Yujia Zhai, Jinyang Liu, Yafan Huang, Ken Raffenetti, Hui Zhou, Kai Zhao, Xiaoyi Lu, Zizhong Chen, Franck Cappello, Yanfei Guo, Rajeev Thakur
2024PPoPPPOSTER: Optimizing Collective Communications with Error-bounded Lossy Compression for GPU Clusters.Jiajun Huang, Sheng Di, Xiaodong Yu, Yujia Zhai, Jinyang Liu, Yafan Huang, Ken Raffenetti, Hui Zhou, Kai Zhao, Zizhong Chen, Franck Cappello, Yanfei Guo, Rajeev Thakur
2024SCcuSZ-i: High-Ratio Scientific Lossy Compression on GPUs with Optimized Multi-Level Interpolation.Jinyang Liu, Jiannan Tian, Shixun Wu, Sheng Di, Boyuan Zhang, Robert Underwood, Yafan Huang, Jiajun Huang, Kai Zhao, Guanpeng Li, Dingwen Tao, Zizhong Chen, Franck Cappello
2024SChZCCL: Accelerating Collective Communication with Co-Designed Homomorphic Compression.Jiajun Huang, Sheng Di, Xiaodong Yu, Yujia Zhai, Jinyang Liu, Zizhe Jian, Xin Liang, Kai Zhao, Xiaoyi Lu, Zizhong Chen, Franck Cappello, Yanfei Guo, Rajeev Thakur
2023CLUSTERPiP-MColl: Process-in-Process-based Multi-object MPI Collectives.Jiajun Huang, Kaiming Ouyang, Yujia Zhai, Jinyang Liu, Min Si, Ken Raffenetti, Hui Zhou, Atsushi Hori, Zizhong Chen, Yanfei Guo, Rajeev Thakur
2023HPDCAccelerating MPI Collectives with Process-in-Process-based Multi-object Techniques.Jiajun Huang, Kaiming Ouyang, Yujia Zhai, Jinyang Liu, Min Si, Ken Raffenetti, Hui Zhou, Atsushi Hori, Zizhong Chen, Yanfei Guo, Rajeev Thakur
2023HPDCFT-GEMM: A Fault Tolerant High Performance GEMM Implementation on x86 CPUs.Shixun Wu, Yujia Zhai, Jiajun Huang, Zizhe Jian, Zizhong Chen
2023ICSFAZ: A flexible auto-tuned modular error-bounded compression framework for scientific data.Jinyang Liu, Sheng Di, Kai Zhao, Xin Liang, Zizhong Chen, Franck Cappello
2023ICSAnatomy of High-Performance GEMM with Online Fault Tolerance on GPUs.Shixun Wu, Yujia Zhai, Jinyang Liu, Jiajun Huang, Zizhe Jian, Bryan M. Wong, Zizhong Chen
2023PPoPPImproving Energy Saving of One-Sided Matrix Decompositions on CPU-GPU Heterogeneous Systems.Jieyang Chen, Xin Liang, Kai Zhao, Hadi Zamani Sabzi, Laxmi N. Bhuyan, Zizhong Chen
2022ICDEMDZ: An Efficient Error-bounded Lossy Compressor for Molecular Dynamics.Kai Zhao, Sheng Di, Danny Perez, Xin Liang, Zizhong Chen, Franck Cappello
2022SCDynamic Quality Metric Oriented Error Bounded Lossy Compression for Scientific Datasets.Jinyang Liu, Sheng Di, Kai Zhao, Xin Liang, Zizhong Chen, Franck Cappello
2021CLUSTERExploring Autoencoder-based Error-bounded Compression for Scientific Data.Jinyang Liu, Sheng Di, Kai Zhao, Sian Jin, Dingwen Tao, Xin Liang, Zizhong Chen, Franck Cappello
2021CLUSTERDaps: A Dynamic Asynchronous Progress Stealing Model for MPI Communication.Kaiming Ouyang, Min Si, Atsushi Hori, Zizhong Chen, Pavan Balaji
2021ICDEOptimizing Error-Bounded Lossy Compression for Scientific Data by Dynamic Spline Interpolation.Kai Zhao, Sheng Di, Maxim Dmitriev, Thierry-Laurent D. Tonellot, Zizhong Chen, Franck Cappello
2021ICSFT-BLAS: a high performance BLAS implementation with online fault tolerance.Yujia Zhai, Elisabeth Giem, Quan Fan, Kai Zhao, Jinyang Liu, Zizhong Chen
2021SCResilient error-bounded lossy compressor for data transfer.Sihuan Li, Sheng Di, Kai Zhao, Xin Liang, Zizhong Chen, Franck Cappello
2020CLUSTERTowards End-to-end SDC Detection for HPC Applications Equipped with Lossy Compression.Sihuan Li, Sheng Di, Kai Zhao, Xin Liang, Zizhong Chen, Franck Cappello
2020HPDCSignificantly Improving Lossy Compression for HPC Datasets with Second-Order Prediction and Parameter Optimization.Kai Zhao, Sheng Di, Xin Liang, Sihuan Li, Dingwen Tao, Zizhong Chen, Franck Cappello
2020ISLPEDSAOU: safe adaptive overclocking and undervolting for energy-efficient GPU computing.Hadi Zamani, Devashree Tripathy, Laxmi N. Bhuyan, Zizhong Chen
2020SCCAB-MPI: exploring interprocess work-stealing towards balanced MPI communication.Kaiming Ouyang, Min Si, Atsushi Hori, Zizhong Chen, Pavan Balaji
2019CCEfficient concolic testing of MPI applications.Hongbo Li, Zizhong Chen, Rajiv Gupta
2019CCGRIDData Transfer between Scientific Facilities - Bottleneck Analysis, Insights and Optimizations.Yuanlai Liu, Zhengchun Liu, Rajkumar Kettimuthu, Nageswara S. V. Rao, Zizhong Chen, Ian T. Foster
2019CLUSTERImproving Performance of Data Dumping with Lossy Compression for Scientific Simulation.Xin Liang, Sheng Di, Dingwen Tao, Sihuan Li, Bogdan Nicolae, Zizhong Chen, Franck Cappello
2019ICSTSM2: optimizing tall-and-skinny matrix-matrix multiplication on GPUs.Jieyang Chen, Nan Xiong, Xin Liang, Dingwen Tao, Sihuan Li, Kaiming Ouyang, Kai Zhao, Nathan DeBardeleben, Qiang Guan, Zizhong Chen
2019ICSGreenMM: energy efficient GPU matrix multiplication through undervolting.Hadi Zamani, Yuanlai Liu, Devashree Tripathy, Laxmi N. Bhuyan, Zizhong Chen
2019SCSignificantly improving lossy compression quality based on an optimized hybrid prediction model.Xin Liang, Sheng Di, Sihuan Li, Dingwen Tao, Bogdan Nicolae, Zizhong Chen, Franck Cappello
2019SCFT-iSort: efficient fault tolerance for introsort.Sihuan Li, Hongbo Li, Xin Liang, Jieyang Chen, Elisabeth Giem, Kaiming Ouyang, Kai Zhao, Sheng Di, Franck Cappello, Zizhong Chen
2018CLUSTERAn Efficient Transformation Scheme for Lossy Data Compression with Point-Wise Relative Error Bound.Xin Liang, Sheng Di, Dingwen Tao, Zizhong Chen, Franck Cappello
2018CLUSTERFixed-PSNR Lossy Compression for Scientific Data.Dingwen Tao, Sheng Di, Xin Liang, Zizhong Chen, Franck Cappello
2018HPDCPerformance analysis and optimization of in-situ integration of simulation with data analysis: zipping applications up.Yuankun Fu, Feng Li, Fengguang Song, Zizhong Chen
2018HPDCImproving performance of iterative methods by lossy checkponting.Dingwen Tao, Sheng Di, Xin Liang, Zizhong Chen, Franck Cappello
2018ICDCSBeeFlow: A Workflow Management System for In Situ Processing across HPC and Cloud Systems.Jieyang Chen, Qiang Guan, Zhao Zhang, Xin Liang, Louis James Vernon, Allen McPherson, Li-Ta Lo, Patricia Grubel, Tim Randles, Zizhong Chen, James P. Ahrens
2018SCFault tolerant one-sided matrix decompositions on heterogeneous systems with GPUs.Jieyang Chen, Hongbo Li, Sihuan Li, Xin Liang, Panruo Wu, Dingwen Tao, Kaiming Ouyang, Yuanlai Liu, Kai Zhao, Qiang Guan, Zizhong Chen
2017PPoPPSilent Data Corruption Resilient Two-sided Matrix Factorizations.Panruo Wu, Nathan DeBardeleben, Qiang Guan, Sean Blanchard, Jieyang Chen, Dingwen Tao, Xin Liang, Kaiming Ouyang, Zizhong Chen
2017SCCorrecting soft errors online in fast fourier transform.Xin Liang, Jieyang Chen, Dingwen Tao, Sihuan Li, Panruo Wu, Hongbo Li, Kaiming Ouyang, Yuanlai Liu, Fengguang Song, Zizhong Chen
2017SCParastack: efficient hang detection for MPI programs at large scale.Hongbo Li, Zizhong Chen, Rajiv Gupta
2016HPDCNew-Sum: A Novel Online ABFT Scheme For General Iterative Methods.Dingwen Tao, Shuaiwen Leon Song, Sriram Krishnamoorthy, Panruo Wu, Xin Liang, Eddy Z. Zhang, Darren J. Kerbyson, Zizhong Chen
2016HPDCTowards Practical Algorithm Based Fault Tolerance in Dense Linear Algebra.Panruo Wu, Qiang Guan, Nathan DeBardeleben, Sean Blanchard, Dingwen Tao, Xin Liang, Jieyang Chen, Zizhong Chen
2016HPDCAlgorithm-Directed Data Placement in Explicitly Managed Non-Volatile Memory.Panruo Wu, Dong Li, Zizhong Chen, Jeffrey S. Vetter, Sparsh Mittal
2016ICPADSsuCAQR: A Simplified Communication-Avoiding QR Factorization Solver Using the TBLAS Framework.Weijian Zheng, Fengguang Song, Lan Lin, Zizhong Chen
2016SCGreenLA: green linear algebra software for GPU-accelerated heterogeneous computing.Jieyang Chen, Li Tan, Panruo Wu, Dingwen Tao, Hongbo Li, Xin Liang, Sihuan Li, Rong Ge, Laxmi N. Bhuyan, Zizhong Chen
2015HPCCSimulated Annealing to Generate Numerically Stable Real Number Error Correction Codes.Teresa Davies, Xin Liang, Jieyang Chen, Zizhong Chen
2014HPDCFT-ScaLAPACK: correcting soft errors on-line for ScaLAPACK cholesky, QR, and LU factorization routines.Panruo Wu, Zizhong Chen
2014ICCSHP-DAEMON: High Performance Distributed Adaptive Energy-efficient Matrix-multiplicatiON.Li Tan, Longxiang Chen, Zizhong Chen, Ziliang Zong, Rong Ge, Dong Li
2014ICPADSExtending checksum-based ABFT to tolerate soft errors online in iterative methods.Longxiang Chen, Dingwen Tao, Panruo Wu, Zizhong Chen
2014PDCATTOUGH2-PETSc: A Parallel Solver for TOUGH2.Daniel Hathorn, Yushu Wu, Zizhong Chen
2014SCTX: algorithmic energy saving for distributed dense matrix factorizations.Li Tan, Zizhong Chen
2013CLUSTERImproving performance and energy efficiency of matrix multiplication via pipeline broadcast.Li Tan, Longxiang Chen, Zizhong Chen, Ziliang Zong, Dong Li, Rong Ge
2013HPDCCorrecting soft errors online in LU factorization.Teresa Davies, Zizhong Chen
2013IPCCCA2E: Adaptively aggressive energy efficient DVFS scheduling for data intensive applications.Li Tan, Zizhong Chen, Ziliang Zong, Dong Li, Rong Ge
2013PPoPPOnline-ABFT: an online algorithm based fault tolerance scheme for soft error detection in iterative methods.Zizhong Chen
2013SCRethinking algorithm-based fault tolerance with a cooperative software-hardware approach.Dong Li, Zizhong Chen, Panruo Wu, Jeffrey S. Vetter
2012CLUSTEROptimizing Process-to-Core Mappings for Application Level Multi-dimensional MPI Communications.Christer Karlsson, Teresa Davies, Zizhong Chen
2012HPCCRuntime Optimization of Broadcast Communications Using Dynamic Network Topology Information from MPI.Jeffrey Godwin, Christer Karlsson, Zizhong Chen
2012PDPReduced Data Communication for Parallel CMA-ES for REACTS.Douglas Hakkarinen, Tracy Camp, Zizhong Chen, Allan Haas
2011HPDCAlgorithm-based recovery for iterative methods without checkpointing.Zizhong Chen
2011ICPPOptimizing Process-to-Core Mappings for Two Dimensional Broadcast/Reduce on Multicore Architectures.Christer Karlsson, Teresa Davies, Chong Ding, Hui Liu, Zizhong Chen
2011ICSSRC: soft error detection and recovery for high performance linpack.Teresa Davies, Zizhong Chen
2011ICSHigh performance linpack benchmark: a fault tolerant implementation without checkpointing.Teresa Davies, Christer Karlsson, Hui Liu, Chong Ding, Zizhong Chen
2011ISPAMatrix Multiplication on GPUs with On-Line Fault Tolerance.Chong Ding, Christer Karlsson, Hui Liu, Teresa Davies, Zizhong Chen
2011PPoPPAlgorithm-based recovery for HPL.Teresa Davies, Zizhong Chen, Christer Karlsson, Hui Liu
2011SCFault tolerant matrix-matrix multiplication: correcting soft errors on-line.Panruo Wu, Chong Ding, Longxiang Chen, Feng Gao, Teresa Davies, Christer Karlsson, Zizhong Chen
2010GECCOConstructing numerically stable real number codes using evolutionary computation.Aaron Garrett, Zizhong Chen, Daniel Eric Smith
2009HPCCN-Level Diskless Checkpointing.Douglas Hakkarinen, Zizhong Chen
2009SCOptimal real number codes for fault tolerant matrix operations.Zizhong Chen
2005ICCSNumerically Stable Real Number Codes Based on Random Matrices.Zizhong Chen, Jack J. Dongarra
2005PPoPPFault tolerant high performance computing by a coding approach.Zizhong Chen, Graham E. Fagg, Edgar Gabriel, Julien Langou, Thara Angskun, George Bosilca, Jack J. Dongarra
2003ICCSSelf-Adapting Software for Numerical Linear Algebra Library Routines on Clusters.Zizhong Chen, Jack J. Dongarra, Piotr Luszczek, Kenneth Roche