| 2025 | DATE | WinAcc: Window-based Acceleration of Neural Networks Using Block Floating Point. | Xin Ju, Jun He, Mei Wen, Jing Feng, Yasong Cao, Junzhong Shen, Zhaoyun Chen, Yang Shi |
| 2025 | DATE | SparSynergy: Unlocking Flexible and Efficient DNN Acceleration Through Multi-Level Sparsity. | Jingkui Yang, Mei Wen, Junzhong Shen, Jianchao Yang, Yasong Cao, Jun He, Minjin Tang, Zhaoyun Chen, Yang Shi |
| 2025 | ICPP | SmartBlock: Adaptive Block Floating Point Quantization for Efficient DNN Acceleration. | Xin Ju, Jingkui Yang, Mei Wen, Jun He, Jing Feng, Minjin Tang, Zhaoyun Chen, Yang Shi |
| 2024 | ICA3PP | MAP-SIM: A Performance Model for Shared-Memory Heterogeneous Systems with Mapping Awareness. | Yuhang Li, Mei Wen, Junzhong Shen, Zhaoyun Chen, Yang Shi |
| 2024 | MICRO | HyFiSS: A Hybrid Fidelity Stall-Aware Simulator for GPGPUs. | Jianchao Yang, Mei Wen, Dong Chen, Zhaoyun Chen, Zeyu Xue, Yuhang Li, Junzhong Shen, Yang Shi |
| 2023 | DAC | Automatic End-to-End Joint Optimization for Kernel Compilation on DSPs. | Xiaolei Zhao, Zhaoyun Chen, Yang Shi, Mei Wen, Chunyun Zhang |
| 2023 | ICCD | Releasing the Potential of Tensor Core for Unstructured SpMM using Tiled-CSR Format. | Zeyu Xue, Mei Wen, Zhaoyun Chen, Yang Shi, Minjin Tang, Jianchao Yang, Zhongdi Luo |
| 2022 | ASPDAC | Exploring ILP for VLIW Architecture by Quantified Modeling and Dynamic Programming-Based Instruction Scheduling. | Can Deng, Zhaoyun Chen, Yang Shi, Xichang Kong, Mei Wen |
| 2022 | HPCC | CORF: Bridging the Gap of Complex Operator Fusion for Faster DNN Inference. | Jianan Wang, Yang Shi, Zhaoyun Chen, Mei Wen |
| 2022 | IPCCC | PickyMan: A Preemptive Scheduler for Deep Learning Jobs on GPU Clusters. | Chen Chen, Yingwen Chen, Zhaoyun Chen, Jianchen Han, Guangtao Xue |
| 2019 | DATE | GENIE: QoS-guided Dynamic Scheduling for CNN-based Tasks on SME Clusters. | Zhaoyun Chen, Lei Luo, Haoduo Yang, Jie Yu, Mei Wen, Chunyuan Zhang |
| 2019 | INFOCOM | Poster Abstract: Deep Learning Workloads Scheduling with Reinforcement Learning on GPU Clusters. | Zhaoyun Chen, Lei Luo, Wei Quan, Mei Wen, Chunyuan Zhang |
| 2018 | HPCC | Multiple CNN-based Tasks Scheduling across Shared GPU Platform in Research and Development Scenarios. | Zhaoyun Chen, Lei Luo, Wei Quan, Yang Shi, Jie Yu, Mei Wen, Chunyuan Zhang |
| 2015 | BMVC | Enable Scale and Aspect Ratio Adaptability in Visual Tracking with Detection Proposals. | Dafei Huang, Lei Luo, Mei Wen, Zhaoyun Chen, Chunyuan Zhang |
| 2015 | ICIP | Fast tracking via context depth model learning. | Zhaoyun Chen, Lei Luo, Mei Wen, Chunyuan Zhang |
| 2014 | ICA3PP | Utilizing Multiple Xeon Phi Coprocessors on One Compute Node. | Xinnan Dong, Jun Chai, Jing Yang, Mei Wen, Nan Wu, Xing Cai, Chunyuan Zhang, Zhaoyun Chen |