| 2026 | AAAI | MoSs: Mixture of Scales for Efficient High-Resolution Autoregressive Image Generation. | Yaoxiu Lian, Hao Liang, Zhihong Gou, Yijia Zhang, Jiaming Xu, Guohao Dai, Ningyi Xu |
| 2026 | ASPDAC | ROMA: A Read-Only-Memory-based Accelerator for QLoRA-based On-Device LLM. | Wenqiang Wang, Yijia Zhang, Zikai Zhang, Guanting Huo, Hao Liang, Shijie Cao, Ningyi Xu |
| 2026 | DATE | RAMP: RTL-Level Emulation with Thousand-Core-Scale Parallelism. | Weigang Feng, Yijia Zhang, Zekun Wang, Zhengyang Wang, Yi Wang, Peijun Ma, Ningyi Xu |
| 2025 | ASPDAC | LLSM: LLM-enhanced Logic Synthesis Model with EDA-guided CoT Prompting, Hybrid Embedding and AIG-tailored Acceleration. | Shan Huang, Jinhao Li, Zhen Yu, Jiancai Ye, Jiaming Xu, Ningyi Xu, Guohao Dai |
| 2025 | DAC | A Cross-model Fusion-aware Framework for Optimizing (gather-matmul-scatter)s Workload. | Yaoxiu Lian, Zhihong Gou, Yibo Han, Zhongming Yu, Jiaming Xu, Sheng Yuan, Zhilin Pei, Xingcheng Zhang, Ningyi Xu, Guohao Dai |
| 2025 | DAC | Speculative Decoding for Verilog: Speed and Quality, All in One. | Changran Xu, Yi Liu, Yunhao Zhou, Shan Huang, Ningyi Xu, Qiang Xu |
| 2025 | DATE | DyLGNN: Efficient LM-GNN Fine-Tuning with Dynamic Node Partitioning, Low-Degree Sparsity, and Asynchronous Sub-Batch. | Zhen Yu, Jinhao Li, Jiaming Xu, Shan Huang, Jiancai Ye, Ningyi Xu, Guohao Dai |
| 2025 | ECAI | LoRA Decompose: Serving Fine-Tuned Models into LoRA-Like. | Yibo Han, Tangzhi Xu, Zenan Li, Yijia Zhang, Youshan Miao, Yuan Yao, Ningyi Xu |
| 2025 | ICLR | DeepGate4: Efficient and Effective Representation Learning for Circuit Design at Scale. | Ziyang Zheng, Shan Huang, Jianyuan Zhong, Zhengyuan Shi, Guohao Dai, Ningyi Xu, Qiang Xu |
| 2025 | ICML | OmniBal: Towards Fast Instruction-Tuning for Vision-Language Models via Omniverse Computation Balance. | Yongqiang Yao, Jingru Tan, Feizhao Zhang, Jiahao Hu, Yazhe Niu, Xin Jin, Bo Li, Pengfei Liu, Ruihao Gong, Dahua Lin, Ningyi Xu |
| 2025 | ICRA | SARO: Space-Aware Robot System for Terrain Crossing via Vision-Language Model. | Shaoting Zhu, Derun Li, Linzhan Mou, Yong Liu, Ningyi Xu, Hang Zhao |
| 2024 | ACL | BitDistiller: Unleashing the Potential of Sub-4-Bit LLMs via Self-Distillation. | Dayou Du, Yijia Zhang, Shijie Cao, Jiaqi Guo, Ting Cao, Xiaowen Chu, Ningyi Xu |
| 2024 | ACL | AFPQ: Asymmetric Floating Point Quantization for LLMs. | Yijia Zhang, Sicheng Zhang, Shijie Cao, Dayou Du, Jianyu Wei, Ting Cao, Ningyi Xu |
| 2024 | ECCV | Leveraging Enhanced Queries of Point Sets for Vectorized Map Construction. | Zihao Liu, Xiaoyu Zhang, Guangwei Liu, Ji Zhao, Ningyi Xu |
| 2024 | ECCV | Enhancing Vectorized Map Perception with Historical Rasterized Maps. | Xiaoyu Zhang, Guangwei Liu, Zihao Liu, Ningyi Xu, Yun-Hui Liu, Ji Zhao |
| 2024 | ICCAD | MARCA: Mamba Accelerator with Reconfigurable Architecture. | Jinhao Li, Shan Huang, Jiaming Xu, Jun Liu, Li Ding, Ningyi Xu, Guohao Dai |
| 2024 | ICCD | VEGA: Implementing a Versatile and Efficient Deep Learning Processor with Graph-Based ALU. | Wenqiang Wang, Yuzhou Chen, Guanting Huo, Guanghui He, Ningyi Xu |
| 2023 | DAC | FLNA: An Energy-Efficient Point Cloud Feature Learning Accelerator with Dataflow Decoupling. | Dongxu Lyu, Zhenyu Li, Yuzhou Chen, Ningyi Xu, Guanghui He |
| 2023 | DAC | COSA:Co-Operative Systolic Arrays for Multi-head Attention Mechanism in Neural Network using Hybrid Data Reuse and Fusion Methodologies. | Zhican Wang, Gang Wang, Honglan Jiang, Ningyi Xu, Guanghui He |
| 2023 | ECAI | Adam Accumulation to Reduce Memory Footprints of Both Activations and Gradients for Large-Scale DNN Training. | Yijia Zhang, Yibo Han, Shijie Cao, Guohao Dai, Youshan Miao, Ting Cao, Fan Yang, Ningyi Xu |
| 2023 | ICCAD | A Point Transformer Accelerator with Fine-Grained Pipelines and Distribution-Aware Dynamic FPS. | Yaoxiu Lian, Xinhao Yang, Ke Hong, Yu Wang, Guohao Dai, Ningyi Xu |
| 2023 | ICCAD | SpOctA: A 3D Sparse Convolution Accelerator with Octree-Encoding-Based Map Search and Inherent Sparsity-Aware Processing. | Dongxu Lyu, Zhenyu Li, Yuzhou Chen, Jinming Zhang, Ningyi Xu, Guanghui He |
| 2021 | ISCAS | A Low-Latency FPGA Implementation for Real-Time Object Detection. | Jinming Zhang, Lifu Cheng, Cen Li, Yongfu Li, Guanghui He, Ningyi Xu, Yong Lian |
| 2017 | FCCM | FP-DNN: An Automated Framework for Mapping Deep Neural Networks onto FPGAs with RTL-HLS Hybrid Templates. | Yijin Guan, Hao Liang, Ningyi Xu, Wenqiang Wang, Shaoshuai Shi, Xi Chen, Guangyu Sun, Wei Zhang, Jason Cong |
| 2017 | FPGA | ForeGraph: Exploring Large-scale Graph Processing on Multi-FPGA Architecture. | Guohao Dai, Tianhao Huang, Yuze Chi, Ningyi Xu, Yu Wang, Huazhong Yang |
| 2017 | IJCNN | FxpNet: Training a deep convolutional neural network in fixed-point representation. | Xi Chen, Xiaolin Hu, Hucheng Zhou, Ningyi Xu |
| 2016 | FPGA | Going Deeper with Embedded FPGA Platform for Convolutional Neural Network. | Jiantao Qiu, Jie Wang, Song Yao, Kaiyuan Guo, Boxun Li, Erjin Zhou, Jincheng Yu, Tianqi Tang, Ningyi Xu, Sen Song, Yu Wang, Huazhong Yang |
| 2016 | SIGCOMM | ClickNP: Highly flexible and High-performance Network Processing with Reconfigurable Hardware. | Bojie Li, Kun Tan, Layong Larry Luo, Yanqing Peng, Renqian Luo, Ningyi Xu, Yongqiang Xiong, Peng Cheng |
| 2014 | DATE | Energy efficient neural networks for big data analytics. | Yu Wang, Boxun Li, Rong Luo, Yiran Chen, Ningyi Xu, Huazhong Yang |
| 2014 | IJCNN | Large scale recurrent neural network on GPU. | Boxun Li, Erjin Zhou, Bo Huang, Jiayi Duan, Yu Wang, Ningyi Xu, Jiaxing Zhang, Huazhong Yang |
| 2011 | DATE | Gemma in April: A matrix-like parallel programming architecture on OpenCL. | Tianji Wu, Di Wu, Yu Wang, Xiaorui Zhang, Hong Luo, Ningyi Xu, Huazhong Yang |
| 2011 | ICCAD | A heterogeneous accelerator platform for multi-subject voxel-based brain network analysis. | Yu Wang, Mo Xu, Ling Ren, Xiaorui Zhang, Di Wu, Yong He, Ningyi Xu, Huazhong Yang |
| 2010 | FPGA | FPMR: MapReduce framework on FPGA. | Yi Shan, Bo Wang, Jing Yan, Yu Wang, Ningyi Xu, Huazhong Yang |
| 2010 | FPGA | LambdaRank acceleration for relevance ranking in web search engines (abstract only). | Jing Yan, Ningyi Xu, Xiongfei Cai, Rui Gao, Yu Wang, Rong Luo, Feng-Hsiung Hsu |
| 2010 | ICPADS | Making Human Connectome Faster: GPU Acceleration of Brain Network Analysis. | Di Wu, Tianji Wu, Yi Shan, Yu Wang, Yong He, Ningyi Xu, Huazhong Yang |
| 2010 | ICPP | Efficient PageRank and SpMV Computation on AMD GPUs. | Tianji Wu, Bo Wang, Yi Shan, Feng Yan, Yu Wang, Ningyi Xu |
| 2009 | FPL | FPGA-based acceleration of neural network for ranking in web search engine with a streaming architecture. | Jing Yan, Ningyi Xu, Xiongfei Cai, Rui Gao, Yu Wang, Rong Luo, Feng-Hsiung Hsu |
| 2009 | ICPADS | RankBoost Acceleration on both NVIDIA CUDA and ATI Stream Platforms. | Bo Wang, Tianji Wu, Feng Yan, Ruirui Li, Ningyi Xu, Yu Wang |
| 2005 | ASPDAC | The design and implementation of a DVB receiving chip with PCI interface. | Ningyi Xu, Shaohua Li, Wei Yu, Guanghui He, Hao Zhang, Fei Luo, Zucheng Zhou |