| 2026 | ICS | Look Before You Leap : Precision Instruction Supply via SmartScout. | Xuefeng Zhang, Peng Qu, Tingji Zhang, Fang Su, Zhe Pan, Youhui Zhang |
| 2026 | PPoPP | PANA: A Fine-Grained Runtime-Adaptive Load Balancing for Parallel SpMV on Multicore CPUs. | Haodong Bian, Youhui Zhang, Xiang Fei, Jianqiang Huang, Xiaoying Wang |
| 2026 | PPoPP | VDHA: Vector-Driven Hash Aggregation for Sparse Matrix-Sparse Vector Multiplication on GPUs. | Yuchen Li, Zhe Pan, Peng Qu, Youhui Zhang |
| 2026 | PPoPP | Root-Down Exposure for Maximal Clique Enumeration on GPUs. | Zhe Pan, Peng Qu, Youhui Zhang |
| 2025 | ASPLOS | Hierarchical Prefetching: A Software-Hardware Instruction Prefetcher for Server Applications. | Tingji Zhang, Boris Grot, Wenjian He, Yashuai Lv, Peng Qu, Fang Su, Wenxin Wang, Guowei Zhang, Xuefeng Zhang, Youhui Zhang |
| 2025 | CCGRID | SoftGuide: A Hardware-Software Co-design Predictor for Data-Dependent Branches. | Xuefeng Zhang, Peng Qu, Tingji Zhang, Xiang Fei, Youhui Zhang |
| 2025 | EuroPar | AlphaSparseTensor: Discovering Faster Sparse Matrix Multiplication Algorithms on GPUs for LLM Inference. | Xuanzheng Wang, Shuo Miao, Zihan Zhu, Peng Qu, Youhui Zhang |
| 2024 | FPL | DTrans: A Dataflow-transformation FPGA Accelerator with Nonlinear-operators fusion aiming for the Generative Model. | Xuanzheng Wang, Shuo Miao, Peng Qu, Youhui Zhang |
| 2024 | ICCD | ChameSC: Virtualizing Superscalar Core of a SIMD Architecture for Vector Memory Access. | Zhongzhu Pu, Guangda Zhang, Tiejian Zhang, Chen Zhang, Youhui Zhang, Xia Zhao |
| 2024 | MICRO | ActiveN: A Scalable and Flexibly-Programmable Event-Driven Neuromorphic Processor. | Xiaoyi Liu, Zhongzhu Pu, Peng Qu, Weimin Zheng, Youhui Zhang |
| 2024 | PPoPP | A Row Decomposition-based Approach for Sparse Matrix Multiplication on GPUs. | Meng Pang, Xiang Fei, Peng Qu, Youhui Zhang, Zhaolin Li |
| 2023 | IJCNN | FABLE: A Development and Computing Framework for Brain-inspired Learning Algorithms. | Meng Pang, Yuchen Li, Zhaolin Li, Youhui Zhang |
| 2023 | ISLPED | Multi-Objective Optimization for Floating Point Mix-Precision Tuning. | Zeqing Li, Yongwei Wu, Youhui Zhang |
| 2023 | MICRO | MAICC : A Lightweight Many-core Architecture with In-Cache Computing for Multi-DNN Parallel Inference. | Renhao Fan, Yikai Cui, Qilin Chen, Mingyu Wang, Youhui Zhang, Weimin Zheng, Zhaolin Li |
| 2022 | CCGRID | Accelerating Neural Network Training with Processing-in-Memory GPU. | Xiang Fei, Jianhui Han, Jianqiang Huang, Weimin Zheng, Youhui Zhang |
| 2022 | DAC | GaBAN: a generic and flexibly programmable vector neuro-processor on FPGA. | Jiajie Chen, Le Yang, Youhui Zhang |
| 2021 | ICPP | Regu2D: Accelerating Vectorization of SpMV on Intel Processors through 2D-partitioning and Regular Arrangement. | Xiang Fei, Youhui Zhang |
| 2020 | ICCAD | SuSy: A Programming Model for Productive Construction of High-Performance Systolic Arrays on FPGAs. | Yi-Hsiang Lai, Hongbo Rong, Size Zheng, Weihao Zhang, Xiuping Cui, Yunshan Jia, Jie Wang, Brendan Sullivan, Zhiru Zhang, Yun Liang, Youhui Zhang, Jason Cong, Nithin George, Jose Alvarez, Christopher J. Hughes, Pradeep Dubey |
| 2019 | ASPLOS | FPSA: A Full System Stack Solution for Reconfigurable ReRAM-based NN Accelerator Architecture. | Yu Ji, Youyang Zhang, Xinfeng Xie, Shuangchen Li, Peiqi Wang, Xing Hu, Youhui Zhang, Yuan Xie |
| 2019 | DAC | Design Guidelines of RRAM based Neural-Processing-Unit: A Joint Device-Circuit-Algorithm Analysis. | Wenqiang Zhang, Xiaochen Peng, Huaqiang Wu, Bin Gao, Hu He, Youhui Zhang, Shimeng Yu, He Qian |
| 2018 | ASPLOS | Bridge the Gap between Neural Networks and Neuromorphic Hardware with a Neural Network Compiler. | Yu Ji, Youhui Zhang, Wenguang Chen, Yuan Xie |
| 2016 | CASES | Neural network transformation under hardware constraints. | Youhui Zhang, Yu Ji, Wenguang Chen, Yuan Xie |
| 2016 | HPCC | Near Data Computation for Message-Passing Chip-Multiprocessors. | Yanhua Li, Youhui Zhang, Kunpeng Song, Haibin Wang, Weiming Zheng |
| 2016 | ICA3PP | Optimized Mapping Spiking Neural Networks onto Network-on-Chip. | Yu Ji, Youhui Zhang, He Liu, Weimin Zheng |
| 2016 | MICRO | NEUTRAMS: Neural network transformation and co-design under neuromorphic hardware constraints. | Yu Ji, Youhui Zhang, Shuangchen Li, Ping Chi, Cihang Jiang, Peng Qu, Yuan Xie, Wenguang Chen |
| 2015 | ICPP | Software-Based Lightweight Multithreading to Overlap Memory-Access Latencies of Commodity Processors. | Cihang Jiang, Youhui Zhang, Weimin Zheng |
| 2014 | ICA3PP | Customized Network-on-Chip for Message Reduction. | Hongwei Wang, Siyu Lu, Youhui Zhang, Guangwen Yang, Weimin Zheng |
| 2013 | FPL | Accelerating solvers for global atmospheric equations through mixed-precision data flow engine. | Lin Gan, Haohuan Fu, Wayne Luk, Chao Yang, Wei Xue, Xiaomeng Huang, Youhui Zhang, Guangwen Yang |
| 2013 | ICA3PP | Cache Optimizations of Distributed Storage for Software Streaming Services. | Youhui Zhang, Peng Qu, Yanhua Li, Hongwei Wang, Weimin Zheng |
| 2013 | MICRO | Aegis: partitioning data block for efficient recovery of stuck-at-faults in phase change memory. | Jie Fan, Song Jiang, Jiwu Shu, Youhui Zhang, Weimin Zhen |
| 2013 | NPC | Software/Hardware Hybrid Network-on-Chip Simulation on FPGA. | Youhui Zhang, Peng Qu, Ziqiang Qian, Hongwei Wang, Weimin Zheng |
| 2006 | ICPADS | Research on Object-Storage-Based Intrusion Detection. | Youhui Zhang, Dongsheng Wang |
| 2006 | SBAC-PAD | Virtual-Machine-based Intrusion Detection on File-aware Block Level Storage. | Youhui Zhang, Yu Gu, Hongyi Wang, Dongsheng Wang |
| 2005 | PDPTA | Thckpt: Transparent Checkpointing of Linux Processes Under IA-64. | Weimin Zheng, Wenguang Chen, Youhui Zhang, Ruini Xue |
| 2004 | ISPA | Parallel Checkpoint/Recovery on Cluster of IA-64 Computers. | Youhui Zhang, Dongsheng Wang, Weimin Zheng |
| 2004 | NPC | The Flexible Replication Method in an Object-Oriented Data Storage System. | Youhui Zhang, Jinfeng Hu, Weimin Zheng |