| 2026 | AAAI | CloserToMe: A Unified Framework for Accurate and Transferable Latency Prediction Across Heterogeneous Devices. | Cheng Tang, Guochong Sui, Wenqi Lou, Zihan Wang, Jiayi Tuo, Wenqian Xie, Yinkang Gao, Yixuan Zhu, Lei Gong, Chao Wang, Xuehai Zhou |
| 2026 | EuroPar | Two-Stage Hierarchy-Aware Learning with Gradient Conflict Mitigation for HLS Latency and Resource Prediction. | Zhiwei Ke, Yiming Liu, Fengrui Zuo, Wenqi Lou, Chao Wang, Xuehai Zhou |
| 2026 | EuroPar | Realizable N:M Sparse Transformer Inference via Search-Kernel Co-design. | Yiming Liu, Wenqi Lou, Zhiguang Wang, Zhiwei Ke, Fengrui Zuo, Chao Wang, Xuehai Zhou |
| 2025 | DAC | UniCoS: A Unified Neural and Accelerator Co-Search Framework for CNNs and ViTs. | Wei Fu, Wenqi Lou, Cheng Tang, Hongbing Wen, Yunji Qin, Lei Gong, Chao Wang, Xuehai Zhou |
| 2025 | EuroPar | CoQMoE: Co-Designed Quantization and Computation Orchestration for Mixture-of-Experts Vision Transformer on FPGA. | Jiale Dong, Hao Wu, Zihao Wang, Wenqi Lou, Zhendong Zheng, Lei Gong, Chao Wang, Xuehai Zhou |
| 2025 | ICPP | Automated FPGA Accelerator Generation Framework for Transformers with Dataflow Optimization. | Wenqi Lou, Yunji Qin, Zihao Wang, Chao Wang, Lei Gong, Xuehai Zhou |
| 2025 | ISCAS | UbiMoE: A Ubiquitous Mixture-of-Experts Vision Transformer Accelerator With Hybrid Computation Pattern on FPGA. | Jiale Dong, Wenqi Lou, Zhendong Zheng, Yunji Qin, Lei Gong, Chao Wang, Xuehai Zhou |
| 2025 | RTSS | TSI: A Time-Semantic Instruction Set for Deterministic Data-Flow Execution in Real-Time Embedded Systems. | Yinkang Gao, Bo Zhang, Yixuan Zhu, Lei Gong, Teng Wang, Wenqi Lou, Chao Wang, Xi Li, Xuehai Zhou |
| 2024 | CLUSTER | Beyond Training: A Zero-Shot Framework to Neural Architecture and Accelerator Co-Exploration. | Wei Fu, Wenqi Lou, Lei Gong, Chao Wang, Xuehai Zhou |
| 2024 | ICCD | AutoSparse: A Source-to-Source Format and Schedule Auto- Tuning Framework for Sparse Tensor Program. | Xiangjun Qu, Lei Gong, Wenqi Lou, Qianyu Cheng, Xianglan Chen, Chao Wang, Xuehai Zhou |
| 2024 | ICCD | UniCoMo: A Unified Learning-Based Cost Model for Tensorized Program Tuning. | Zihan Wang, Lei Gong, Wenqi Lou, Qianyu Cheng, Xianglan Chen, Chao Wang, Xuehai Zhou |
| 2024 | ICCD | Fine-Grained Shared Cache Interference Analysis Using Basic Block's Execution Time. | Yixuan Zhu, Wenqi Lou, Yinkang Gao, Binze Jiang, Xiaohang Gong, Xi Li |
| 2024 | PRICAI | MFNAS: Multi-fidelity Exploration in Neural Architecture Search with Stable Zero-Shot Proxy. | Wei Fu, Wenqi Lou, Yunji Qin, Lei Gong, Chao Wang, Xuehai Zhou |
| 2023 | DATE | NAF: Deeper Network/Accelerator Co-Exploration for Customizing CNNs on FPGA. | Wenqi Lou, Jiaming Qian, Lei Gong, Xuan Wang, Chao Wang, Xuehai Zhou |
| 2023 | FPGA | hAP: A Spatial-von Neumann Heterogeneous Automata Processor with Optimized Resource and IO Overhead on FPGA. | Xuan Wang, Lei Gong, Jing Cao, Wenqi Lou, Weiya Wang, Chao Wang, Xuehai Zhou |
| 2022 | ACCV | TCL-Net: A Lightweight and Efficient Dehazing Network with Frequency-Domain Fusion and Multi-Angle Attention. | Cheng Tang, Wenqi Lou |
| 2020 | CLUSTER | OctCNN: An Energy-Efficient FPGA Accelerator for CNNs using Octave Convolution Algorithm. | Wenqi Lou, Chao Wang, Lei Gong, Xuehai Zhou |