| 2026 | DATE | EstCoder: A RTL Code Generator based on Static Functional Estimation. | Qi Xiong, Renzhi Chen, Zhigang Fang, Bowei Wang, Yingjie Zhou, Libo Huang, Lei Wang |
| 2026 | ISCA | Revisiting Global Value Prediction: A Resurgent Complement to Local Predictors. | Ling Yang, Libo Huang, Zhong Zheng, Bingcai Sui, Sheng Ma, Yongwen Wang, Li Shen, Junhui Wang, Gang Chen, Qianming Yang, Songwen Pei, Weixia Xu |
| 2025 | AAAI | MPQ-DM: Mixed Precision Quantization for Extremely Low Bit Diffusion Models. | Weilun Feng, Haotong Qin, Chuanguang Yang, Zhulin An, Libo Huang, Boyu Diao, Fei Wang, Renshuai Tao, Yongjun Xu, Michele Magno |
| 2025 | AAAI | HSRDiff: A Hierarchical Self-Regulation Diffusion Model for Stochastic Semantic Segmentation. | Han Yang, Chuanguang Yang, Zhulin An, Libo Huang, Yongjun Xu |
| 2025 | AAAI | Multi-Teacher Knowledge Distillation with Reinforcement Learning for Visual Recognition. | Chuanguang Yang, Xinqiang Yu, Han Yang, Zhulin An, Chengqing Yu, Libo Huang, Yongjun Xu |
| 2025 | CASES | RISC-TAE: Instruction Set Extension for Transformer Model Acceleration. | Fei Liu, Yanping Shao, Zhouquan Liu, Jing Zhang, Junbo Tie, Mingche Lai, Gang Chen, Libo Huang |
| 2025 | CVPR | Multi-party Collaborative Attention Control for Image Customization. | Han Yang, Chuanguang Yang, Qiuli Wang, Zhulin An, Weilun Feng, Libo Huang, Yongjun Xu |
| 2025 | DATE | Late Breaking Results: AFS: Improving Accuracy of Quantized Mamba via Aggressive Forgetting Strategy. | Zhouquan Liu, Libo Huang, Ling Yang, Gang Chen, Wei Liu, Mingche Lai, Yongwen Wang |
| 2025 | EuroPar | SONet: Towards Practical Online Neural Network for Enhancing Hard-to-Predict Branches. | Zhenxuan Xiong, Libo Huang, Ling Yang, Hui Guo, Junhui Wang, Zhong Zheng, Songwen Pei, Gang Chen, Yongwen Wang |
| 2025 | HPCC | X-SA: An Efficient Configurable Systolic Array Computing Architecture for GPGPU. | Yingsong Wang, Zhenzhen Jia, Ling Yang, Hongbing Tan, Junsheng Chang, Junbo Tie, Libo Huang |
| 2025 | ICA3PP | HT-DLC: A Data Layout and Computing Design for Logic-in-Memory Convolution with High Throughput. | Ziyi Bo, Nuo Xu, Kang Liu, Anning Zhao, Chenghao Tan, Libo Huang |
| 2025 | ICA3PP | Low-Cost Approximate Floating-Point Multiplier Design Based on SSA and Sparse Processing. | Xin Peng, Pengcheng Li, Gang Chen, Mingche Lai, Lin Deng, Qianmin Yang, Yongwen Wang, Libo Huang |
| 2025 | ICA3PP | Facess: A Fast Access Method for Shared Data Among Multi-cores in Parallel Programs. | Junhui Wang, Jierong Tang, Shiyuan Wang, Yijing Peng, Hongwei Zhou, Quanyou Feng, Libo Huang, Yongwen Wang |
| 2025 | ICASSP | IOR: Inversed Objects Replay for Incremental Object Detection. | Zijia An, Boyu Diao, Libo Huang, Ruiqi Liu, Zhulin An, Yongjun Xu |
| 2025 | ICASSP | OLN++: Improved Object Localization Network for Open-world Object Detection. | Haonan Mai, Libo Huang, Zhulin An, Jiarui Zhao, Chuanguang Yang, Erhu Zhao, Yongjun Xu |
| 2025 | ICCD | PolyPE: An Efficient Multi-Precision Multi-Mode Floating-Point Processing Element for HPC and AI. | Zhenzhen Jia, Hongbing Tan, Ling Yang, Hui Guo, Kun Zeng, Junsheng Chang, Yongwen Wang, Libo Huang |
| 2025 | ICML | Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers. | Weilun Feng, Chuanguang Yang, Haotong Qin, Xiangqi Li, Yu Wang, Zhulin An, Libo Huang, Boyu Diao, Zixiang Zhao, Yongjun Xu, Michele Magno |
| 2025 | ICML | Geometric Feature Embedding for Effective 3D Few-Shot Class Incremental Learning. | Xiangqi Li, Libo Huang, Zhulin An, Weilun Feng, Chuanguang Yang, Boyu Diao, Fei Wang, Yongjun Xu |
| 2025 | ISCAS | Classification-Based False Alarm Suppression for SAR Target Detection. | Nan Yang, Libo Huang, Zhulin An, Yongjun Xu, Xia Hong, Wing-Kuen Ling |
| 2025 | SPAA | Brief Announcement: LCTree: A Fast Hardware BVH Constructor for Real-Time Ray Tracing. | Run Yan, Su Yin, Hui Guo, Yongwen Wang, Gang Chen, Nong Xiao, Libo Huang |
| 2024 | AAAI | eTag: Class-Incremental Learning via Embedding Distillation and Task-Oriented Generation. | Libo Huang, Yan Zeng, Chuanguang Yang, Zhulin An, Boyu Diao, Yongjun Xu |
| 2024 | CSCWD | Class-wise Image Mixture Guided Self-Knowledge Distillation for Image Classification. | Zeyu Dong, Chuanguang Yang, Yuqi Li, Libo Huang, Zhulin An, Yongjun Xu |
| 2024 | CSCWD | Online Relational Knowledge Distillation for Image Classification. | Yihang Zhou, Chuanguang Yang, Yuqi Li, Libo Huang, Zhulin An, Yongjun Xu |
| 2024 | CVPR | CLIP-KD: An Empirical Study of CLIP Model Distillation. | Chuanguang Yang, Zhulin An, Libo Huang, Junyu Bi, Xinqiang Yu, Han Yang, Boyu Diao, Yongjun Xu |
| 2024 | EuroPar | ImSPU: Implicit Sharing of Computation Resources Between Vector and Scalar Processing Units. | Hongbing Tan, Xiaowei He, Guichu Sun, Liquan Xiao, Yuanhu Cheng, Jing Zhang, Zhong Zheng, Quan Deng, Bingcai Sui, Yongwen Wang, Libo Huang |
| 2024 | ICA3PP | SSC: An SRAM-Based Silence Computing Design for On-chip Memory. | Ziming Chen, Quan Deng, Yiyue Hu, Xiaowei He, Libo Huang, Yongwen Wang |
| 2024 | ICLR | KFC: Knowledge Reconstruction and Feedback Consolidation Enable Efficient and Effective Continual Generative Learning. | Libo Huang, Zhulin An, Yan Zeng, Xiang Zhi, Yongjun Xu |
| 2024 | IJCNN | Online Policy Distillation with Decision-Attention. | Xinqiang Yu, Chuanguang Yang, Chengqing Yu, Libo Huang, Zhulin An, Yongjun Xu |
| 2024 | ISPA | DiffSenseNet: Integrating Hierarchical Features and Angular Diffusion for Remote Sensing Object Detection. | Songwen Pei, Hongli Ma, Xinyun Qiu, Libo Huang |
| 2023 | EuroPar | A Multi-level Parallel Integer/Floating-Point Arithmetic Architecture for Deep Learning Instructions. | Hongbing Tan, Jing Zhang, Libo Huang, Xiaowei He, Dezun Dong, Yongwen Wang, Liquan Xiao |
| 2023 | ICCD | SFDoP: A Scalable Fused BFloat16 Dot-Product Architecture for DNN. | Jing Zhang, Hongbing Tan, Libo Huang |
| 2022 | ACCV | Wavelet-Based Mamba with Fourier Adjustment for Low-Light Image Enhancement. | Junhao Tan, Songwen Pei, Wei Qin, Bo Fu, Ximing Li, Libo Huang |
| 2022 | HPCC | RTA: an Efficient SIMD Architecture for Ray Tracing. | Run Yan, Libo Huang, Hui Guo, Yashuai L, Ling Yang, Nong Xiao, Li Shen, Yongwen Wang |
| 2022 | ICA3PP | PipeFB: An Optimized Pipeline Parallelism Scheme to Reduce the Peak Memory Usage. | Wei Jiang, Bo Wang, Sheng Ma, Xiang Hou, Libo Huang, Yi Dai, Jianbin Fang |
| 2022 | ICA3PP | Efficient Multiple-Precision and Mixed-Precision Floating-Point Fused Multiply-Accumulate Unit for HPC and AI Applications. | Hongbing Tan, Run Yan, Ling Yang, Libo Huang, Liquan Xiao, Qianming Yang |
| 2022 | NPC | Optimizing Winograd Convolution on GPUs via Partial Kernel Fusion. | Gan Tong, Run Yan, Ling Yang, Mengqiao Lan, Jing Zhang, Yuanhu Cheng, Wentao Ma, Yashuai L, Sheng Ma, Libo Huang |
| 2022 | NPC | SADD: A Novel Systolic Array Accelerator with Dynamic Dataflow for Sparse GEMM in Deep Learning. | Bo Wang, Sheng Ma, Zhong Liu, Libo Huang, Yuan Yuan, Yi Dai |
| 2021 | ICASSP | Multi-Scale Cascade Disparity Refinement Stereo Network. | Xiaogang Jia, Wei Chen, Zhengfa Liang, Xin Luo, Mingfei Wu, Yusong Tan, Libo Huang |
| 2021 | ICRA | Multi-Scale Cost Volumes Cascade Network for Stereo Matching. | Xiaogang Jia, Wei Chen, Chen Li, Zhengfa Liang, Mingfei Wu, Yusong Tan, Libo Huang |
| 2019 | DATE | Improving the DRAM Access Efficiency for Matrix Multiplication on Multicore Accelerators. | Sheng Ma, Yang Guo, Shenggang Chen, Libo Huang, Zhiying Wang |
| 2019 | ISCAS | An Efficient Direct Memory Access (DMA) Controller for Scientific Computing Accelerators. | Sheng Ma, Libo Huang, Yuanwu Lei, Yang Guo, Zhiying Wang |
| 2019 | ISPASS | Hierarchical Page Eviction Policy for Unified Memory in GPUs. | Qi Yu, Bruce R. Childers, Libo Huang, Cheng Qian, Zhiying Wang |
| 2018 | FIE | Peer-Formulated Assignment Method for Experimental Projects in CS courses. | Xin Zhang, Libo Huang, Zhiying Wang, Qi Yu |
| 2018 | ICA3PP | VISU: A Simple and Efficient Cache Coherence Protocol Based on Self-updating. | Ximing He, Sheng Ma, Wenjie Liu, Sijiang Fan, Libo Huang, Zhiying Wang, Zhanyong Zhou |
| 2018 | ISCAS | Adaptive VC Partitioning for NoCs in GPGPUs. | Sheng Ma, Hongyi Lu, Libo Huang, Li Shen, Yang Guo, Zhiying Wang, Wenliang Xue |
| 2018 | ISPA | Improving Branch Prediction Accuracy on Multi-Core Architectures for Big Data. | Qi Yu, Libo Huang, Hui Guo, Cheng Qian, Sheng Ma, Zhiying Wang |
| 2018 | ISPASS | HMCSP: Reducing Transaction Latency of CSR-based SPMV in Hybrid Memory Cube. | Cheng Qian, Bruce R. Childers, Libo Huang, Qi Yu, Zhiying Wang |
| 2018 | ISPASS | Evaluating Memory Performance of Emerging Scale-Out Applications Using C-AMAT. | Qi Yu, Libo Huang, Cheng Qian, Jianqiao Ma, Zhiying Wang |
| 2017 | ICCD | Effective Optimization of Branch Predictors through Lightweight Simulation. | Chaobing Zhou, Libo Huang, Tan Zhang, Yongwen Wang, Chengyi Zhang, Qiang Dou |
| 2017 | MICRO | Unleashing the power of GPU for physically-based rendering via dynamic ray shuffling. | Ya-Shuai L, Libo Huang, Li Shen, Zhiying Wang |
| 2017 | NPC | Improving Branch Prediction for Thread Migration on Multi-core Architectures. | Tan Zhang, Chaobing Zhou, Libo Huang, Nong Xiao, Sheng Ma |
| 2017 | SIGITE | Motivating Students through Peer-Formulated Assignments in CS Experimental Courses. | Xin Zhang, Jinfeng Huang, Libo Huang, Zhiying Wang |
| 2017 | VECoS | Factor-Based C-AMAT Analysis for Memory Optimization. | Qi Yu, Libo Huang, Cheng Qian, Jianqiao Ma, Zhiying Wang |
| 2015 | FPL | Fast FPGA system for microarchitecture optimization on synthesizable modern processor design. | Libo Huang, Yongwen Wang, Qiang Dou, Chengyi Zhang, Caixia Sun, Chao Xu |
| 2015 | ICA3PP | A Study on Non-volatile 3D Stacked Memory for Big Data Applications. | Cheng Qian, Libo Huang, Peng Xie, Nong Xiao, Zhiying Wang |
| 2014 | DATE | Leveraging on-chip networks for efficient prediction on multicore coherence. | Libo Huang |
| 2013 | HPCC | DCP: Improving the Throughput of Asynchronous Pipeline by Dual Control Path. | Bo Su, Li Shen, Lei Wang, Zhiying Wang, Yourui Wang, Libo Huang, Wei Shi |
| 2011 | DATE | A specialized low-cost vectorized loop buffer for embedded processors. | Libo Huang, Zhiying Wang, Li Shen, Hongyi Lu, Nong Xiao, Cong Liu |
| 2010 | HPCA | SIF: Overcoming the limitations of SIMD devices via implicit permutation. | Libo Huang, Li Shen, Zhiying Wang, Wei Shi, Nong Xiao, Sheng Ma |
| 2010 | ICA3PP | SV: Enhancing SIMD Architectures via Combined SIMD-Vector Approach. | Libo Huang, Zhiying Wang |
| 2010 | ISCAS | Permutation optimization for SIMD devices. | Libo Huang, Li Shen, Zhiying Wang |
| 2008 | CISIS | Memory System Design for a Multi-core Processor. | Jianjun Guo, Ming-che Lai, Zhengyuan Pang, Libo Huang, Fangyuan Chen, Kui Dai, Zhiying Wang |
| 2008 | DAC | Customizing computation accelerators for extensible multi-issue processors with effective optimization techniques. | Ya-Shuai L, Li Shen, Libo Huang, Zhiying Wang, Nong Xiao |
| 2008 | SAC | Hierarchical memory system design for a heterogeneous multi-core processor. | Jianjun Guo, Ming-che Lai, Zhengyuan Pang, Libo Huang, Fangyuan Chen, Kui Dai, Zhiying Wang |
| 2007 | ARITH | A New Architecture For Multiple-Precision Floating-Point Multiply-Add Fused Unit Design. | Libo Huang, Li Shen, Kui Dai, Zhiying Wang |