| 2025 | DAC | Me-MPK: Accelerating Krylov Subspace Solvers via Memory-efficient Matrix-Power Kernel. | Haozhong Qiu, Chuanfu Xu, Jianbin Fang, Shengguo Li, Liang Deng, Jian Zhang, Zhe Dai, Yue Ding, Yue Wang, Zhimeng Han, Yonggang Che, Jie Liu |
| 2025 | ICASSP | Gated Cross-Attention Network for Depth Completion. | Xiaogang Jia, Songlei Jian, Yusong Tan, Yonggang Che, Wei Chen, Zhengfa Liang |
| 2025 | ICPP | Optimizing Direct Convolutions on High-Performance Multi-Core DSPs. | Pengyu Wang, Xiaotian Chen, Jianbin Fang, Peng Zhang, Yonggang Che, Chun Huang, Jie Ren |
| 2025 | SC | Constraint-Driven Auto-Tuning of GEMM-like Operators for MT-3000 Many-core Processor. | Xinxin Qi, Jianbin Fang, Peng Zhang, Yonggang Che, Jie Ren |
| 2024 | ICA3PP | MARO: Enabling Full MPI Automatic Refactoring in DSL-Based Programming Framework. | Tong Lei, Zongjing Chen, Yonggang Che, Chuanfu Xu |
| 2024 | ICPP | Optimizing Stencil Computation on Multi-core DSPs. | Fugeng Zhu, Xinxin Qi, Peng Zhang, Jianbin Fang, Tao Tang, Yonggang Che, Kainan Yu, Jing Xie, Chun Huang, Jie Ren |
| 2024 | PPoPP | Towards Scalable Unstructured Mesh Computations on Shared Memory Many-Cores. | Haozhong Qiu, Chuanfu Xu, Jianbin Fang, Liang Deng, Jian Zhang, Qingsong Wang, Yue Ding, Zhe Dai, Yonggang Che, Shizhao Chen, Jie Liu |
| 2024 | SC | A Conflict-aware Divide-and-Conquer Algorithm for Symmetric Sparse Matrix-Vector Multiplication. | Haozhong Qiu, Chuanfu Xu, Jianbin Fang, Jian Zhang, Liang Deng, Yue Ding, Qingsong Wang, Shizhao Chen, Yonggang Che, Jie Liu |
| 2023 | ICA3PP | PowerDis: Fine-Grained Power Monitoring Through Power Disaggregation Model. | Xinxin Qi, Juan Chen, Rongyu Deng, Zekai Li, Lin Deng, Yuan Yuan, Yonggang Che |
| 2023 | ICPADS | Developing a proxy application for an industrial unstructured CFD software: preliminary results. | Qingsong Wang, Chuanfu Xu, Jian Zhang, Liang Deng, Zhe Dai, Haozhong Qiu, Weixi Dai, Yongzhen Lin, Yue Ding, Yonggang Che |
| 2022 | HPCC | GPU Parallelization and Optimization of a Combustion Simulation Application. | Zhixiang Liao, Yongzhou Liu, Yonggang Che |
| 2020 | PDCAT | Memory Access Optimization of High-Order CFD Stencil Computations on GPU. | Shengxiang Wang, Zhuoqian Li, Yonggang Che |
| 2019 | ISPA | OpenMP4.5-Enabled Large-Scale Heterogeneous Lattice Boltzmann Multiphase Flow Simulations. | Chuanfu Xu, Xi Wang, Dali Li, Yonggang Che, Zhenghua Wang |
| 2019 | NPC | Collaborating CPUs and MICs for Large-Scale LBM Multiphase Flow Simulations. | Chuanfu Xu, Xi Wang, Dali Li, Yonggang Che, Zhenghua Wang |
| 2009 | HPCC | A Framework for Effective Memory Optimization of High Performance Computing Applications. | Pingjing Lu, Yonggang Che, Zhenghua Wang |
| 2008 | HPCC | An Effective Iterative Compilation Search Algorithm for High Performance Computing Applications. | Pingjing Lu, Yonggang Che, Zhenghua Wang |
| 2008 | ISPA | Analyzing the Efficiency and Bottleneck of Scientific Programs on Imagine Stream Processor by Simulation. | Yonggang Che, Chuanfu Xu, Zhenghua Wang |
| 2004 | ISPA | Locality Optimizations for Jacobi Iteration on Distributed Parallel Systems. | Yonggang Che, Zhenghua Wang, Xiaomei Li, Laurence Tianruo Yang |