| 2026 | FPGA | UDP: A Universal DSP Packing Framework for Low-bitwidth MAC Acceleration on FPGAs. | Jundong Wu, Zhendong Zheng, Lei Gong, Chao Wang, Xuehai Zhou |
| 2026 | SIGIR | HE-DeepFM: An FHE Inference System for CTR Prediction with Efficient FM Interactions. | Qiyue Su, Hang Gu, Zhiguang Wang, Teng Wang, Zhendong Zheng, Qianyu Cheng, Lei Gong, Chao Wang |
| 2025 | DAC | Late Breaking Results: A Fast Nearest Neighbor Search Acceleration for 3D Point Cloud. | Jinao Li, Teng Wang, Qianyu Cheng, Zhendong Zheng, Lei Gong, Chao Wang, Xi Li, Xuehai Zhou |
| 2025 | EuroPar | CoQMoE: Co-Designed Quantization and Computation Orchestration for Mixture-of-Experts Vision Transformer on FPGA. | Jiale Dong, Hao Wu, Zihao Wang, Wenqi Lou, Zhendong Zheng, Lei Gong, Chao Wang, Xuehai Zhou |
| 2025 | ISCAS | UbiMoE: A Ubiquitous Mixture-of-Experts Vision Transformer Accelerator With Hybrid Computation Pattern on FPGA. | Jiale Dong, Wenqi Lou, Zhendong Zheng, Yunji Qin, Lei Gong, Chao Wang, Xuehai Zhou |
| 2024 | FCCM | Ph.D. Project: Achieving Low-Latency Acceleration on Multi-FPGA for GPT Application. | Zhendong Zheng, Teng Wang, Chao Wang |
| 2024 | FPL | SoGraph: A State-Aware Architecture for Out-of-Memory Graph Processing on HBM-Equipped FPGAs. | Qianyu Cheng, Zhendong Zheng, Tianhao Jiang, Cheng Tang, Teng Wang, Lei Gong, Chao Wang, Xuehai Zhou |
| 2024 | FPL | LORA: A Latency-Oriented Recurrent Architecture for GPT Model on Multi-FPGA Platform with Communication Optimization. | Zhendong Zheng, Qianyu Cheng, Teng Wang, Lei Gong, Xianglan Chen, Cheng Tang, Chao Wang, Xuehai Zhou |
| 2019 | ICNC | Topic Clustering Analysis of Online Judge System. | Jianyu Liu, Shaohong Zhang, Liqing Cai, Zhendong Zheng |