Skip to content

Lei Gong

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

58

Venues

26

Active years

2008–2026

Best venue rank

A*

Where they publish

Papers

58 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAICloserToMe: A Unified Framework for Accurate and Transferable Latency Prediction Across Heterogeneous Devices.Cheng Tang, Guochong Sui, Wenqi Lou, Zihan Wang, Jiayi Tuo, Wenqian Xie, Yinkang Gao, Yixuan Zhu, Lei Gong, Chao Wang, Xuehai Zhou
2026FPGAUDP: A Universal DSP Packing Framework for Low-bitwidth MAC Acceleration on FPGAs.Jundong Wu, Zhendong Zheng, Lei Gong, Chao Wang, Xuehai Zhou
2026WWWMulti-field Balance-aware Calibration of Predictions in Online Advertising.Zi-Kang Wang, Lei Gong, Shu-Ting Shi, Lan-Zhe Guo, Muyu Zhang
2026SIGIRHE-DeepFM: An FHE Inference System for CTR Prediction with Efficient FM Interactions.Qiyue Su, Hang Gu, Zhiguang Wang, Teng Wang, Zhendong Zheng, Qianyu Cheng, Lei Gong, Chao Wang
2025CLUSTERA similarity-aware MOE-based method for optimizing tensor programs across diverse GPUs.Haowen Hou, Zihan Wang, Yining Song, Lei Gong, Chao Wang, Xi Li, Xuehai Zhou
2025CLUSTEROptimizing the Execution Core for Value Prediction in Superscalar Processors.Yibo Zhang, Lei Gong, Chao Wang, Xuehai Zhou
2025DACLate Breaking Results: Source-Aware Adaptive Cache Management for CXL-enabled Disaggregated Memory Sharing.Qianyu Cheng, Jiajun Ji, Teng Wang, Zihan Wang, Lei Gong, Chao Wang, Xuehai Zhou
2025DACUniCoS: A Unified Neural and Accelerator Co-Search Framework for CNNs and ViTs.Wei Fu, Wenqi Lou, Cheng Tang, Hongbing Wen, Yunji Qin, Lei Gong, Chao Wang, Xuehai Zhou
2025DACLate Breaking Results: A Fast Nearest Neighbor Search Acceleration for 3D Point Cloud.Jinao Li, Teng Wang, Qianyu Cheng, Zhendong Zheng, Lei Gong, Chao Wang, Xi Li, Xuehai Zhou
2025DACAn Efficient Bit-level Sparse MAC-accelerated Architecture with SW/HW Co-design on FPGA.Chenming Zhang, Lei Gong, Chao Wang, Xuehai Zhou
2025EuroParCoQMoE: Co-Designed Quantization and Computation Orchestration for Mixture-of-Experts Vision Transformer on FPGA.Jiale Dong, Hao Wu, Zihao Wang, Wenqi Lou, Zhendong Zheng, Lei Gong, Chao Wang, Xuehai Zhou
2025FCCMPh.D. Project: A Novel Compilation-Based Approach for Generating Sparse Tensor Accelerators.Xingyan Chen, Lei Gong, Chao Wang
2025ICDMBoosting Clinical Outcome Prediction with Context-Aware Feature Imputation and Disentanglement.Lei Gong, Aidong Zhang, Kishlay Jha
2025ICPPAutomated FPGA Accelerator Generation Framework for Transformers with Dataflow Optimization.Wenqi Lou, Yunji Qin, Zihao Wang, Chao Wang, Lei Gong, Xuehai Zhou
2025ISCASResDDQN-FPGA: A Reinforcement Learning Framework for Dynamic and Efficient Control in Resonant DC-DC Converters.Yutong Chen, Hai Li, Lei Gong, Chao Wang
2025ISCASUbiMoE: A Ubiquitous Mixture-of-Experts Vision Transformer Accelerator With Hybrid Computation Pattern on FPGA.Jiale Dong, Wenqi Lou, Zhendong Zheng, Yunji Qin, Lei Gong, Chao Wang, Xuehai Zhou
2025RTSSTSI: A Time-Semantic Instruction Set for Deterministic Data-Flow Execution in Real-Time Embedded Systems.Yinkang Gao, Bo Zhang, Yixuan Zhu, Lei Gong, Teng Wang, Wenqi Lou, Chao Wang, Xi Li, Xuehai Zhou
2025RTSSWork-in-Progress: A Timing-Anomaly Free Dynamic Scheduling on Heterogeneous Systems.Yixuan Zhu, Yinkang Gao, Binze Jiang, Xiaohang Gong, Lei Gong, Chao Wang, Xi Li, Xuehai Zhou
2024AAAISDAC: A Multimodal Synthetic Dataset for Anomaly and Corner Case Detection in Autonomous Driving.Lei Gong, Yu Zhang, Yingqing Xia, Yanyong Zhang, Jianmin Ji
2024CLUSTERBeyond Training: A Zero-Shot Framework to Neural Architecture and Accelerator Co-Exploration.Wei Fu, Wenqi Lou, Lei Gong, Chao Wang, Xuehai Zhou
2024FIEClustering Entity Relationship Diagrams: Enhancing Feedback Quality and Grading Consistency in Large Database Courses.Sohum Thadani, Andrey Shor, Soohong Ahn, Lei Gong, Abdussalam Alawini, Hisham Benotman
2024FPLSoGraph: A State-Aware Architecture for Out-of-Memory Graph Processing on HBM-Equipped FPGAs.Qianyu Cheng, Zhendong Zheng, Tianhao Jiang, Cheng Tang, Teng Wang, Lei Gong, Chao Wang, Xuehai Zhou
2024FPLLORA: A Latency-Oriented Recurrent Architecture for GPT Model on Multi-FPGA Platform with Communication Optimization.Zhendong Zheng, Qianyu Cheng, Teng Wang, Lei Gong, Xianglan Chen, Cheng Tang, Chao Wang, Xuehai Zhou
2024FPLFlexWalker: An Efficient Multi-Objective Design Space Exploration Framework for HLS Design.Zheyuan Zou, Cheng Tang, Lei Gong, Chao Wang, Xuehai Zhou
2024ICCDAutoSparse: A Source-to-Source Format and Schedule Auto- Tuning Framework for Sparse Tensor Program.Xiangjun Qu, Lei Gong, Wenqi Lou, Qianyu Cheng, Xianglan Chen, Chao Wang, Xuehai Zhou
2024ICCDUniCoMo: A Unified Learning-Based Cost Model for Tensorized Program Tuning.Zihan Wang, Lei Gong, Wenqi Lou, Qianyu Cheng, Xianglan Chen, Chao Wang, Xuehai Zhou
2024PAKDDLocal Subsequence-Based Distribution for Time Series Clustering.Lei Gong, Hang Zhang, Zongyou Liu, Kai Ming Ting, Yang Cao, Ye Zhu
2024PRICAIMFNAS: Multi-fidelity Exploration in Neural Architecture Search with Stable Zero-Shot Proxy.Wei Fu, Wenqi Lou, Yunji Qin, Lei Gong, Chao Wang, Xuehai Zhou
2023CCGRIDA flexible dataflow CNN accelerator on FPGA.Haoran Li, Lei Gong, Chao Wang, Xuehai Zhou
2023CCGRIDSparse-HeteroCL: From Sparse Tensor Algebra to Highly Customized Accelerators on FPGAs.Jize Pang, Lei Gong, Chao Wang, Xuehai Zhou
2023DATEFastRW: A Dataflow-Efficient and Memory-Aware Accelerator for Graph Random Walk on FPGAs.Yingxue Gao, Teng Wang, Lei Gong, Chao Wang, Xi Li, Xuehai Zhou
2023DATENAF: Deeper Network/Accelerator Co-Exploration for Customizing CNNs on FPGA.Wenqi Lou, Jiaming Qian, Lei Gong, Xuan Wang, Chao Wang, Xuehai Zhou
2023FCCMEnabling Elastic Resource Management in Cloud FPGAs via A Multi-layer Collaborative Approach.Wenbin Teng, Lei Gong, Chao Wang, Xuehai Zhou
2023FCCMDataMaster: A GNN-based Data Type Optimizer for Dataflow Design in FPGA.Zheyuan Zou, Lei Gong, Chao Wang, Xuehai Zhou
2023FPGAhAP: A Spatial-von Neumann Heterogeneous Automata Processor with Optimized Resource and IO Overhead on FPGA.Xuan Wang, Lei Gong, Jing Cao, Wenqi Lou, Weiya Wang, Chao Wang, Xuehai Zhou
2022FPLSDMA: An Efficient and Flexible Sparse-Dense Matrix-Multiplication Architecture for GNNs.Yingxue Gao, Lei Gong, Chao Wang, Teng Wang, Xuehai Zhou
2022IJCAIAttributed Graph Clustering with Dual Redundancy Reduction.Lei Gong, Sihang Zhou, Wenxuan Tu, Xinwang Liu
2022ISPAWGeod: A General and Efficient FPGA Accelerator for Object Detection.Zihan Wang, Mengying Zhao, Lei Gong, Chao Wang
2022NPCMulti-clusters: An Efficient Design Paradigm of NN Accelerator Architecture Based on FPGA.Teng Wang, Lei Gong, Chao Wang, Yang Yang, Yingxue Gao
2021DATELAP: A Lightweight Automata Processor for Pattern Matching Tasks.Haojun Xia, Lei Gong, Chao Wang, Xianglan Chen, Xuehai Zhou
2021ICCDUH-JLS: A Parallel Ultra-High Throughput JPEG-LS Encoding Architecture for Lossless Image Compression.Xuan Wang, Lei Gong, Chao Wang, Xi Li, Xuehai Zhou
2021ISPAVapor: A GPU Sharing Scheduler with Communication and Computation Pipeline for Distributed Deep Learning.Xiaorui Zhu, Lei Gong, Zongwei Zhu, Xuehai Zhou
2020CLUSTEROctCNN: An Energy-Efficient FPGA Accelerator for CNNs using Octave Convolution Algorithm.Wenqi Lou, Chao Wang, Lei Gong, Xuehai Zhou
2020FPGAConvCloud: An Adaptive Convolutional Neural Network Accelerator on Cloud FPGAs.Yang Yang, Chao Wang, Lei Gong, Xuehai Zhou
2020HPCCChameleon: Image Style Transfer Based on Image Classification Networks.Haobo Li, Ratan Dey, Lei Gong, Chao Wang
2019CLUSTERDesign Exploration of Multi-FPGAs for Accelerating Deep Learning.Teng Wang, Lei Gong, Chao Wang, Xuehai Zhou, Huaping Chen
2018FPGADomino: An Asynchronous and Energy-efficient Accelerator for Graph Processing: (Abstract Only).Chongchong Xu, Chao Wang, Yiwei Zhang, Lei Gong, Xi Li, Xuehai Zhou
2018ICWSDomino: Graph Processing Services on Energy-Efficient Hardware Accelerator.Chongchong Xu, Chao Wang, Lei Gong, Lihui Jin, Xi Li, Xuehai Zhou
2017CASESA high-performance FPGA accelerator for sparse neural networks: work-in-progress.Yuntao Lu, Lei Gong, Chongchong Xu, Fan Sun, Yiwei Zhang, Chao Wang, Xuehai Zhou
2017CLUSTERA Power-Efficient Accelerator for Convolutional Neural Networks.Fan Sun, Chao Wang, Lei Gong, Chongchong Xu, Yiwei Zhang, Yuntao Lu, Xi Li, Xuehai Zhou
2017CLUSTEROmniGraph: A Scalable Hardware Accelerator for Graph Processing.Chongchong Xu, Chao Wang, Lei Gong, Yuntao Lu, Fan Sun, Yiwei Zhang, Xi Li, Xuehai Zhou
2017CLUSTERA Power-Efficient Accelerator Based on FPGAs for LSTM Network.Yiwei Zhang, Chao Wang, Lei Gong, Yuntao Lu, Fan Sun, Chongchong Xu, Xi Li, Xuehai Zhou
2017ICWSGenServ: Genome Sequencing Services on Scalable Energy Efficient Accelerators.Chao Wang, Haijie Fang, Shiming Lei, Lei Gong, Aili Wang, Xi Li, Xuehai Zhou
2017ICWSxFilter: A Temporal Locality Accelerator for Intrusion Detection System Services.Chao Wang, Jinhong Zhou, Lei Gong, Xi Li, Aili Wang, Xuehai Zhou
2017ICWSEvaluation and Trade-offs of Graph Processing for Cloud Services.Chongchong Xu, Jinhong Zhou, Yuntao Lu, Fan Sun, Lei Gong, Chao Wang, Xi Li, Xuehai Zhou
2017ISPAA High-Performance Accelerator for Large-Scale Convolutional Neural Networks.Fan Sun, Chao Wang, Lei Gong, Chongchong Xu, Yiwei Zhang, Yuntao Lu, Xi Li, Xuehai Zhou
2017ISPAImplementation and Optimization of the Accelerator Based on FPGA Hardware for LSTM Network.Yiwei Zhang, Chao Wang, Lei Gong, Yuntao Lu, Fan Sun, Chongchong Xu, Xi Li, Xuehai Zhou
2008ICPADSLink Availability Prediction in Ad Hoc Networks.Lei Gong, Yuebin Bai, Ming Chen, Depei Qian