| 2026 | EuroPar | SparX: Cache-Aware Sparse Matrix Multiplication Kernels on AMX-Based CPUs. | Ziqi Wang, Dongsheng Li, Huayou Su |
| 2025 | DASFAA | Heterogeneous Feature-Aware Graph Neural Network for Tabular Data. | Hongxiao Fei, Jinqi Hu, Liu Yang, Tingxuan Chen, Huayou Su, Zanqun Liu |
| 2024 | ICSE | Prism: Decomposing Program Semantics for Code Clone Detection through Compilation. | Haoran Li, Siqian Wang, Weihong Quan, Xiaoli Gong, Huayou Su, Jin Zhang |
| 2024 | IWQoS | SyncIntellects: Orchestrating LLM Inference with Progressive Prediction and QoS-Friendly Control. | Xue Lin, Zhibo Zhang, Peining Yue, Haoran Li, Jin Zhang, Baoyu Fan, Huayou Su, Xiaoli Gong |
| 2023 | ICA3PP | Optimizing GNN Inference Processing on Very Long Vector Processor. | Kangkang Chen, Huayou Su, Chaorun Liu, Yalin Li |
| 2022 | HPCC | Optimizing GNN on ARM Multi-Core Processors. | Chaorun Liu, Huayou Su, Yong Dou, Kangkang Chen, Yanjie Sun |
| 2022 | ICA3PP | An Efficient Transformer Inference Engine on DSP. | Kangkang Chen, Huayou Su, Chaorun Liu, Xiaoli Gong |
| 2021 | ICASSP | Graphcomm: A Graph Neural Network Based Method for Multi-Agent Reinforcement Learning. | Siqi Shen, Yongquan Fu, Huayou Su, Hengyue Pan, Peng Qiao, Yong Dou, Cheng Wang |
| 2020 | HPCC | Optimization and Performance Modeling of Stencil Computations on ARM Architectures. | Kaifang Zhang, Huayou Su, Peng Zhang, Yong Dou |
| 2020 | HPCC | Data Layout Transformation for Stencil Computations Using ARM NEON Extension. | Kaifang Zhang, Huayou Su, Peng Zhang, Yong Dou |
| 2020 | ICASSP | Learning Network Representation Through Reinforcement Learning. | Siqi Shen, Yongquan Fu, Adele Lu Jia, Huayou Su, Qinglin Wang, Chengsong Wang, Yong Dou |
| 2020 | ISCC | A High-Throughput LDPC Decoder Based on GPUs for 5G New Radio. | Rongchun Li, Xin Zhou, Hengyue Pan, Huayou Su, Yong Dou |
| 2019 | IJCNN | Author Disambiguation through Adversarial Network Representation Learning. | Liwen Peng, Siqi Shen, Dongsheng Li, Jun Xu, Yongquan Fu, Huayou Su |
| 2019 | INFOCOM | Poster Abstract: A Template-based Framework for Generating Network Processor in FPGA. | Zhuang Cao, Huayou Su, Qianming Yang, Mei Wen, Chunyuan Zhang |
| 2018 | IJCNN | Deep Discriminative Clustering Network. | Xuying Shaol, Ke-shi Ge, Huayou Su, Lei Luo, Baoyun Peng, Dongsheng Li |
| 2013 | ICCS | Performance of Sediment Transport Simulations on NVIDIA's Kepler Architecture. | Huayou Su, Nan Wu, Mei Wen, Chunyuan Zhang, Xing Cai |
| 2013 | ICPADS | On the GPU-CPU Performance Portability of OpenCL for 3D Stencil Computations. | Huayou Su, Nan Wu, Mei Wen, Chunyuan Zhang, Xing Cai |
| 2012 | CLUSTER | Using 1000+ GPUs and 10000+ CPUs for Sedimentary Basin Simulations. | Mei Wen, Huayou Su, Wenjie Wei, Nan Wu, Xing Cai, Chunyuan Zhang |
| 2012 | ICPADS | A Parallel H.264 Encoder with CUDA: Mapping and Evaluation. | Nan Wu, Mei Wen, Huayou Su, Ju Ren, Chunyuan Zhang |
| 2012 | PDCAT | Improving Performance of GPU Specific OpenCL Program on CPUs. | Qiang Lan, Changqing Xun, Mei Wen, Huayou Su, Lifang Liu, Chunyuan Zhang |
| 2011 | ICIG | A Multilevel Parallel Intra Coding for H.264/AVC Based on CUDA. | Huayou Su, Nan Wu, Chunyuan Zhang, Mei Wen, Ju Ren |