| 2026 | HPCA | A Deadlock-Free Bridge Module for Inter-Chiplet Cache-Coherent Communication in an Open Chiplet Ecosystem. | Zhiqiang Chen, Wenwen Fu, Yongwen Wang, Hongwei Zhou |
| 2026 | ISCA | Revisiting Global Value Prediction: A Resurgent Complement to Local Predictors. | Ling Yang, Libo Huang, Zhong Zheng, Bingcai Sui, Sheng Ma, Yongwen Wang, Li Shen, Junhui Wang, Gang Chen, Qianming Yang, Songwen Pei, Weixia Xu |
| 2026 | SPAA | Reducing Off-Chip Prefetch Request Latency of LLC Hardware Prefetchers via Neural Prediction. | Zhengwei Huang, Wei Guo, Yongwen Wang |
| 2025 | DATE | Late Breaking Results: AFS: Improving Accuracy of Quantized Mamba via Aggressive Forgetting Strategy. | Zhouquan Liu, Libo Huang, Ling Yang, Gang Chen, Wei Liu, Mingche Lai, Yongwen Wang |
| 2025 | EuroPar | SONet: Towards Practical Online Neural Network for Enhancing Hard-to-Predict Branches. | Zhenxuan Xiong, Libo Huang, Ling Yang, Hui Guo, Junhui Wang, Zhong Zheng, Songwen Pei, Gang Chen, Yongwen Wang |
| 2025 | ICA3PP | Low-Cost Approximate Floating-Point Multiplier Design Based on SSA and Sparse Processing. | Xin Peng, Pengcheng Li, Gang Chen, Mingche Lai, Lin Deng, Qianmin Yang, Yongwen Wang, Libo Huang |
| 2025 | ICA3PP | Facess: A Fast Access Method for Shared Data Among Multi-cores in Parallel Programs. | Junhui Wang, Jierong Tang, Shiyuan Wang, Yijing Peng, Hongwei Zhou, Quanyou Feng, Libo Huang, Yongwen Wang |
| 2025 | ICCD | PolyPE: An Efficient Multi-Precision Multi-Mode Floating-Point Processing Element for HPC and AI. | Zhenzhen Jia, Hongbing Tan, Ling Yang, Hui Guo, Kun Zeng, Junsheng Chang, Yongwen Wang, Libo Huang |
| 2025 | IJCNN | Initial-Key Cache: An Efficient KV Cache Strategy Focusing on Initial and Key Tokens for LLMs. | Zhongyi Tang, Zejiang He, Junzhong Shen, Yiyue Hu, Luchen Zhou, Yongzhang Nie, Yongwen Wang |
| 2025 | SPAA | Brief Announcement: LCTree: A Fast Hardware BVH Constructor for Real-Time Ray Tracing. | Run Yan, Su Yin, Hui Guo, Yongwen Wang, Gang Chen, Nong Xiao, Libo Huang |
| 2024 | EuroPar | ImSPU: Implicit Sharing of Computation Resources Between Vector and Scalar Processing Units. | Hongbing Tan, Xiaowei He, Guichu Sun, Liquan Xiao, Yuanhu Cheng, Jing Zhang, Zhong Zheng, Quan Deng, Bingcai Sui, Yongwen Wang, Libo Huang |
| 2024 | ICA3PP | SSC: An SRAM-Based Silence Computing Design for On-chip Memory. | Ziming Chen, Quan Deng, Yiyue Hu, Xiaowei He, Libo Huang, Yongwen Wang |
| 2024 | ICPADS | Priority-aware deadlock recovery algorithm for multi-chiplet systems. | Zhiqiang Chen, Yongwen Wang, Hongwei Zhou, Mengjin Li |
| 2024 | ISPA | Hybrid Deadlock Recovery Algorithm for Irregular NoC in Multi-Chiplet Systems. | Zhiqiang Chen, Yongwen Wang, Hongwei Zhou |
| 2023 | EuroPar | A Multi-level Parallel Integer/Floating-Point Arithmetic Architecture for Deep Learning Instructions. | Hongbing Tan, Jing Zhang, Libo Huang, Xiaowei He, Dezun Dong, Yongwen Wang, Liquan Xiao |
| 2023 | ICPADS | Fast Approximate LUT-based Vector Multiplication in DRAM. | Ziming Chen, Quan Deng, Yongwen Wang |
| 2022 | HPCC | RTA: an Efficient SIMD Architecture for Ray Tracing. | Run Yan, Libo Huang, Hui Guo, Yashuai L, Ling Yang, Nong Xiao, Li Shen, Yongwen Wang |
| 2017 | ICCD | Effective Optimization of Branch Predictors through Lightweight Simulation. | Chaobing Zhou, Libo Huang, Tan Zhang, Yongwen Wang, Chengyi Zhang, Qiang Dou |
| 2015 | FPL | Fast FPGA system for microarchitecture optimization on synthesizable modern processor design. | Libo Huang, Yongwen Wang, Qiang Dou, Chengyi Zhang, Caixia Sun, Chao Xu |
| 2004 | WISE | An Efficient Broadcast Algorithm Based on Connected Dominating Set in Unstructured Peer-to-Peer Network. | Qianbing Zheng, Wei Peng, Yongwen Wang, Xicheng Lu |