| 2026 | PPoPP | A Diagonal Block Memory-Aware Polynomial Preconditioner for Linear and Eigenvalue Solvers. | Xiaojian Yang, Yuhui Ni, Fan Yuan, Shengguo Li, Dezun Dong, Chuanfu Xu, Haipeng Jia, Jie Liu |
| 2024 | HPDC | HAM-SpMSpV: an Optimized Parallel Algorithm for Masked Sparse Matrix-Sparse Vector Multiplications on multi-core CPUs. | Lei Xu, Haipeng Jia, Yunquan Zhang, Luhan Wang, Xianmeng Jiang |
| 2023 | ICPADS | SA_TRSM: A Shape-Aware Auto-Tuning Framework for Small-Scale Irregular-Shaped TRSM. | Rongyuan Guo, Haipeng Jia, Yunquan Zhang, Mingsen Deng, Cunyang Wei, Wenbin Chang, Xiang Zhao |
| 2023 | ICS | OpenFFT: An Adaptive Tuning Framework for 3D FFT on ARM Multicore CPUs. | Tun Chen, Haipeng Jia, Yunquan Zhang, Kun Li, Zhihao Li, Xiang Zhao, Jianyu Yao, Chendi Li |
| 2023 | PPoPP | Generating Fast FFT Kernels on CPUs via FFT-Specific Intrinsics. | Zhihao Li, Haipeng Jia, Yunquan Zhang, Yuyan Sun, Yiwei Zhang, Tun Chen |
| 2022 | HPCC | EgpuIP: An Embedded GPU Accelerated Library for Image Processing. | Luhan Wang, Haipeng Jia, Yunquan Zhang, Kun Li, Cunyang Wei |
| 2022 | HPCC | LBBGEMM: A Load-balanced Batch GEMM Framework on ARM CPU s. | Cunyang Wei, Haipeng Jia, Yunquan Zhang, Kun Li, Luhan Wang |
| 2022 | ICPP | IATF: An Input-Aware Tuning Framework for Compact BLAS Based on ARMv8 CPUs. | Cunyang Wei, Haipeng Jia, Yunquan Zhang, Liusha Xu, Ji Qi |
| 2021 | HPCC | A Transpose-free Three-dimensional FFT Algorithm on ARM CPUs. | Tun Chen, Haipeng Jia, Zhihao Li, Chendi Li, Yunquan Zhang |
| 2021 | ICPADS | IAAT: A Input-Aware Adaptive Tuning framework for Small GEMM. | Jianyu Yao, Boqian Shi, Chunyang Xiang, Haipeng Jia, Chendi Li, Hang Cao, Yunquan Zhang |
| 2021 | ISPA | AutoTSMM: An Auto-tuning Framework for Building High-Performance Tall-and-Skinny Matrix-Matrix Multiplication on CPUs. | Chendi Li, Haipeng Jia, Hang Cao, Jianyu Yao, Boqian Shi, Chunyang Xiang, Jinbo Sun, Pengqi Lu, Yunquan Zhang |
| 2019 | SC | AutoFFT: a template-based FFT codes auto-generation framework for ARM and X86 CPUs. | Zhihao Li, Haipeng Jia, Yunquan Zhang, Tun Chen, Liang Yuan, Luning Cao, Xiao Wang |
| 2018 | ICA3PP | Implementation and Optimization of Multi-dimensional Real FFT on ARMv8 Platform. | Xiao Wang, Haipeng Jia, Zhihao Li, Yunquan Zhang |
| 2017 | ICPADS | HartSift: A High-Accuracy and Real-Time SIFT Based on GPU. | Zhihao Li, Haipeng Jia, Yunquan Zhang |
| 2015 | HPCC | Optimized Password Recovery for Encrypted RAR on GPUs. | Xiaojing An, Haipeng Jia, Yunquan Zhang |
| 2015 | ICPP | Optimizing Image Sharpening Algorithm on GPU. | Mengran Fan, Haipeng Jia, Yunquan Zhang, Xiaojing An, Ting Cao |
| 2014 | HPCC | Research on Mahalanobis Distance Algorithm Optimization Based on OpenCL. | Qingchun Xie, Yunquan Zhang, Haipeng Jia, Yongquan Lu |
| 2013 | HPCC | CLSIFT: An Optimization Study of the Scale Invariance Feature Transform on GPUs. | Weiyan Wang, Yunquan Zhang, Guoping Long, Shengen Yan, Haipeng Jia |
| 2012 | EuroPar | GPURoofline: A Model for Guiding Performance Optimizations on GPUs. | Haipeng Jia, Yunquan Zhang, Guoping Long, Jianliang Xu, Shengen Yan, Yan Li |
| 2012 | HPCC | Accelerating Viola-Jones Facce Detection Algorithm on GPUs. | Haipeng Jia, Yunquan Zhang, Weiyan Wang, Jianliang Xu |
| 2012 | ICA3PP | An Insightful Program Performance Tuning Chain for GPU Computing. | Haipeng Jia, Yunquan Zhang, Guoping Long, Shengen Yan |
| 2011 | ICPADS | Automatic FFT Performance Tuning on OpenCL GPUs. | Yan Li, Yunquan Zhang, Haipeng Jia, Guoping Long, Ke Wang |
| 2006 | ISDA | Evolutionary Based Intelligent Algorithm for Topology Optimization of Structure. | Chundong Jiang, Haipeng Jia |