Skip to content

Wenqi Lou

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

17

Venues

12

Active years

2020–2026

Best venue rank

A*

Where they publish

Papers

17 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAICloserToMe: A Unified Framework for Accurate and Transferable Latency Prediction Across Heterogeneous Devices.Cheng Tang, Guochong Sui, Wenqi Lou, Zihan Wang, Jiayi Tuo, Wenqian Xie, Yinkang Gao, Yixuan Zhu, Lei Gong, Chao Wang, Xuehai Zhou
2026EuroParTwo-Stage Hierarchy-Aware Learning with Gradient Conflict Mitigation for HLS Latency and Resource Prediction.Zhiwei Ke, Yiming Liu, Fengrui Zuo, Wenqi Lou, Chao Wang, Xuehai Zhou
2026EuroParRealizable N:M Sparse Transformer Inference via Search-Kernel Co-design.Yiming Liu, Wenqi Lou, Zhiguang Wang, Zhiwei Ke, Fengrui Zuo, Chao Wang, Xuehai Zhou
2025DACUniCoS: A Unified Neural and Accelerator Co-Search Framework for CNNs and ViTs.Wei Fu, Wenqi Lou, Cheng Tang, Hongbing Wen, Yunji Qin, Lei Gong, Chao Wang, Xuehai Zhou
2025EuroParCoQMoE: Co-Designed Quantization and Computation Orchestration for Mixture-of-Experts Vision Transformer on FPGA.Jiale Dong, Hao Wu, Zihao Wang, Wenqi Lou, Zhendong Zheng, Lei Gong, Chao Wang, Xuehai Zhou
2025ICPPAutomated FPGA Accelerator Generation Framework for Transformers with Dataflow Optimization.Wenqi Lou, Yunji Qin, Zihao Wang, Chao Wang, Lei Gong, Xuehai Zhou
2025ISCASUbiMoE: A Ubiquitous Mixture-of-Experts Vision Transformer Accelerator With Hybrid Computation Pattern on FPGA.Jiale Dong, Wenqi Lou, Zhendong Zheng, Yunji Qin, Lei Gong, Chao Wang, Xuehai Zhou
2025RTSSTSI: A Time-Semantic Instruction Set for Deterministic Data-Flow Execution in Real-Time Embedded Systems.Yinkang Gao, Bo Zhang, Yixuan Zhu, Lei Gong, Teng Wang, Wenqi Lou, Chao Wang, Xi Li, Xuehai Zhou
2024CLUSTERBeyond Training: A Zero-Shot Framework to Neural Architecture and Accelerator Co-Exploration.Wei Fu, Wenqi Lou, Lei Gong, Chao Wang, Xuehai Zhou
2024ICCDAutoSparse: A Source-to-Source Format and Schedule Auto- Tuning Framework for Sparse Tensor Program.Xiangjun Qu, Lei Gong, Wenqi Lou, Qianyu Cheng, Xianglan Chen, Chao Wang, Xuehai Zhou
2024ICCDUniCoMo: A Unified Learning-Based Cost Model for Tensorized Program Tuning.Zihan Wang, Lei Gong, Wenqi Lou, Qianyu Cheng, Xianglan Chen, Chao Wang, Xuehai Zhou
2024ICCDFine-Grained Shared Cache Interference Analysis Using Basic Block's Execution Time.Yixuan Zhu, Wenqi Lou, Yinkang Gao, Binze Jiang, Xiaohang Gong, Xi Li
2024PRICAIMFNAS: Multi-fidelity Exploration in Neural Architecture Search with Stable Zero-Shot Proxy.Wei Fu, Wenqi Lou, Yunji Qin, Lei Gong, Chao Wang, Xuehai Zhou
2023DATENAF: Deeper Network/Accelerator Co-Exploration for Customizing CNNs on FPGA.Wenqi Lou, Jiaming Qian, Lei Gong, Xuan Wang, Chao Wang, Xuehai Zhou
2023FPGAhAP: A Spatial-von Neumann Heterogeneous Automata Processor with Optimized Resource and IO Overhead on FPGA.Xuan Wang, Lei Gong, Jing Cao, Wenqi Lou, Weiya Wang, Chao Wang, Xuehai Zhou
2022ACCVTCL-Net: A Lightweight and Efficient Dehazing Network with Frequency-Domain Fusion and Multi-Angle Attention.Cheng Tang, Wenqi Lou
2020CLUSTEROctCNN: An Energy-Efficient FPGA Accelerator for CNNs using Octave Convolution Algorithm.Wenqi Lou, Chao Wang, Lei Gong, Xuehai Zhou