| 2026 | CGO | From Threads to Tiles: T2T, a Compiler for CUDA-to-NPU Translation via 2D Vectorization. | Shuaijiang Li, Jiacheng Zhao, Ying Liu, Shuoming Zhang, Lei Chen, Yijin Li, Yangyu Zhang, Zhicheng Li, Runyu Zhou, Xiyu Shi, Chunwei Xia, Yuan Wen, Xiaobing Feng, Huimin Cui |
| 2026 | ISCA | Symbiotic MLLM Serving: Dynamically Balancing Parallelism Across GPUs and Resources Within GPUs. | Zhicheng Li, Jiacheng Zhao, Yangyu Zhang, Zhaolin Duan, Xinyu Liu, Siqi Li, Shuoming Zhang, Shuaijiang Li, Donglin Yu, Yuan Wen, Chunwei Xia, Xiyu Shi, Huimin Cui |
| 2026 | PPoPP | ParDiff: Efficiently Parallelizing Reverse-Mode Automatic Differentiation with Direct Indexing. | Shuhong Huang, Shizhi Tang, Yuan Wen, Huanqi Cao, Ruibai Tang, Yidong Chen, Jiping Yu, Yang Li, Chao Jiang, Limin Xiao, Jidong Zhai |
| 2024 | ASPDAC | O.O: Optimized One-die Placement for Face-to-face Bonded 3D ICs. | Xingyu Tong, Zhijie Cai, Peng Zou, Min Wei, Yuan Wen, Zhifeng Lin, Jianli Chen |
| 2024 | ASPDAC | Effective Analytical Placement for Advanced Hybrid-Row-Height Circuit Designs. | Yuan Wen, Benchao Zhu, Zhifeng Lin, Jianli Chen |
| 2024 | ASPLOS | Optimizing Deep Learning Inference via Global Analysis and Tensor Expressions. | Chunwei Xia, Jiacheng Zhao, Qianqi Sun, Zheng Wang, Yuan Wen, Teng Yu, Xiaobing Feng, Huimin Cui |
| 2020 | ICA3PP | An Improved Heterogeneous Dynamic List Schedule Algorithm. | Wei Hu, Yu Gan, Yuan Wen, Xiangyu Lv, Yonghao Wang, Xiao Zeng, Meikang Qiu |
| 2020 | ICA3PP | Design of a Convolutional Neural Network Instruction Set Based on RISC-V and Its Microarchitecture Implementation. | Qiang Jiao, Wei Hu, Yuan Wen, Yong Dong, Zhenhao Li, Yu Gan |
| 2020 | SMC | Research on Plant Disease Recognition Based on Deep Complementary Feature Classification Network. | JiaYou Chen, Hong Guo, Wei Hu, Juanjuan He, Yonghao Wang, Yuan Wen |
| 2020 | SMC | A Improved List Heuristic Scheduling Algorithm for Heterogeneous Computing Systems. | Wei Hu, Yu Gan, Xiangyu Lv, Yonghao Wang, Yuan Wen |
| 2020 | SMC | Generative Adversarial Training for Weakly Supervised Nuclei Instance Segmentation. | Wei Hu, Huanhuan Sheng, Jing Wu, Yining Li, Tianyi Liu, Yonghao Wang, Yuan Wen |
| 2020 | SBAC-PAD | TASO: Time and Space Optimization for Memory-Constrained DNN Inference. | Yuan Wen, Andrew Anderson, Valentin Radu, Michael F. P. O'Boyle, David Gregg |
| 2018 | PPoPP | MaxPair: Enhance OpenCL Concurrent Kernel Execution by Weighted Maximum Matching. | Yuan Wen, Michael F. P. O'Boyle, Christian Fensch |
| 2017 | PPoPP | Merge or Separate?: Multi-job Scheduling for OpenCL Kernels on CPU/GPU Platforms. | Yuan Wen, Michael F. P. O'Boyle |
| 2014 | HiPC | Smart multi-task scheduling for OpenCL programs on CPU/GPU heterogeneous platforms. | Yuan Wen, Zheng Wang, Michael F. P. O'Boyle |
| 2014 | NOMS | QoE-based bandwidth allocation with SDN in FTTH networks. | Kailong Li, Wei Guo, Wenyu Zhang, Yuan Wen, Chengjun Li, Weisheng Hu |
| 2009 | FPGA | HMMer acceleration using systolic array based reconfigurable architecture. | Yanteng Sun, Peng Li, Guochang Gu, Yuan Wen, Yuan Liu, Dong Liu |
| 2009 | VINCI | Multi-dimensional Data Visualization using Concentric Coordinates. | Jiawan Zhang, Yuan Wen, Quang Vinh Nguyen, Liang Fu Lu, Mao Lin Huang, Jiadong Yang, Jizhou Sun |
| 2005 | ISCAS | Application of radiation mode in desired sound field generation using loudspeaker array. | Yuan Wen, Woon-Seng Gan, Jun Yang |