Skip to content

Jingwen Leng

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

83

Venues

27

Active years

2013–2026

Best venue rank

A*

Where they publish

Papers

83 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLOn the (In-)Security of the Shuffling Defense in the Transformer Secure Inference.Zhengyi Li, Yakai Wang, Jingwen Leng, Kang Yang, Yu Yu, Jiaping Gui, Yu Feng, Ning Liu, Minyi Guo
2026ACLCuBridge: An LLM-Based Framework for Understanding and Reconstructing High-Performance Attention Kernels.Xing Ma, Yangjie Zhou, Wu Sun, Zihan Liu, Jingwen Leng, Yun Lin, Shixuan Sun, Minyi Guo, Jin Song Dong
2026ASPLOSMWeiming Hu, Zihan Zhang, Haoyan Zhang, Chen Zhang, Cong Guo, Yu Feng, Tianchi Hu, Guanglin Li, Guipeng Hu, Junsong Wang, Jingwen Leng
2026ASPLOSNebula: Infinite-Scale 3D Gaussian Splatting in VR via Collaborative Rendering and Accelerated Stereo Rasterization.He Zhu, Zheng Liu, Xingyang Li, Anbang Wu, Jieru Zhao, Fangxin Liu, Yiming Gan, Jingwen Leng, Yu Feng
2026HPCAFlashFuser: Expanding the Scale of Kernel Fusion for Compute-Intensive Operators via Inter-Core Connection.Ziyu Huang, Yangjie Zhou, Zihan Liu, Xinhao Luo, Yijia Diao, Minyi Guo, Jidong Zhai, Yu Feng, Chen Zhang, Anbang Wu, Jingwen Leng
2026HPCASPLATONIC: Architectural Support for 3D Gaussian Splatting SLAM via Sparse Processing.Xiaotong Huang, He Zhu, Tianrui Ma, Yuxiang Xiong, Fangxin Liu, Zhezhi He, Yiming Gan, Zihan Liu, Jingwen Leng, Yu Feng, Minyi Guo
2026HPCACLINE: Improving Control Flow Compilation of Quantum Programs with Control Line Encoding.Anbang Wu, Liqiang Lu, Jianwei Yin, Jingwen Leng, Minyi Guo
2026HPCATowards Compute-Aware In-Switch Computing for LLMs Tensor-Parallelism on Multi-GPU Systems.Chen Zhang, Qijun Zhang, Zhuoshan Zhou, Yijia Diao, Haibo Wang, Zhe Zhou, Zhipeng Tu, Zhiyao Li, Guangyu Sun, Zhuoran Song, Zhigang Ji, Jingwen Leng, Minyi Guo
2026HPDCFluxZK: Scalable and Efficient Zero-Knowledge Proof Computation via GPU Acceleration.Xinwei Qiang, Liukun Yu, Xiyu Wang, Zhengyi Li, Shixuan Sun, Jingwen Leng, Chen Chen, Jiaping Gui, Zhenzhe Zheng, Jin Dong, Minyi Guo
2026ISCAAccelerating MoE with Dynamic In-Switch Computing on Multi-GPUs.Qijun Zhang, Chen Zhang, Zhuoshan Zhou, Haibo Wang, Zhe Zhou, Zhipeng Tu, Guangyu Sun, Zhiyao Xie, Yijia Diao, Zhigang Ji, Jingwen Leng, Guanghui He, Minyi Guo
2026ISCAMoE-Hub: Taming Software Complexity for Seamless MoE Overlap with Hardware-Accelerated Communication on Multi-GPU Systems.Zhuoshan Zhou, Chen Zhang, Shuyi Zhang, Qijun Zhang, Haibo Wang, Zhe Zhou, Zhipeng Tu, Guangyu Sun, Yijia Diao, Zhigang Ji, Jingwen Leng, Guanghui He, Minyi Guo
2025ACLGumbel Reranking: Differentiable End-to-End Reranker Optimization.Siyuan Huang, Zhiyuan Ma, Jintao Du, Changhua Meng, Weiqiang Wang, Jingwen Leng, Minyi Guo, Zhouhan Lin
2025ASPLOSVoyager: Input-Adaptive Algebraic Transformations for High-Performance Graph Neural Networks.Yangjie Zhou, Wenting Shen, Jingwen Leng, Shuwen Lu, Zihan Liu, Weihao Cui, Zhendong Zhang, Wencong Xiao, Baole Ai, Yong Li, Wei Lin, Deze Zeng, Yun Liang, Quan Chen, Ning Liu, Minyi Guo
2025ASPLOSStreamGrid: Streaming Point Cloud Analytics via Compulsory Splitting and Deterministic Termination.Yu Feng, Zheng Liu, Weikai Lin, Zihan Liu, Jingwen Leng, Minyi Guo, Zhezhi He, Jieru Zhao, Yuhao Zhu
2025DACArbiterQ: Improving QNN Convergency and Accuracy by Applying Personalized Model on Heterogeneous Quantum Devices.Tianyao Chu, Siwei Tan, Liqiang Lu, Jingwen Leng, Fangxin Liu, Congliang Lang, Yifan Guo, Jianwei Yin
2025HPCAVQ-LLM: High-performance Code Generation for Vector Quantization Augmented LLM Inference.Zihan Liu, Xinhao Luo, Junxian Guo, Wentao Ni, Yangjie Zhou, Yue Guan, Cong Guo, Weihao Cui, Yu Feng, Minyi Guo, Yuhao Zhu, Minjia Zhang, Chen Jin, Jingwen Leng
2025HPCAM-ANT: Efficient Low-bit Group Quantization for LLMs via Mathematically Adaptive Numerical Type.Weiming Hu, Haoyan Zhang, Cong Guo, Yu Feng, Renyang Guan, Zhendong Hua, Zihan Liu, Yue Guan, Minyi Guo, Jingwen Leng
2025ICASSPWeightedKV: Attention Scores Weighted Key-Value Cache Merging for Large Language Models.Jian Yuan, Ziwei He, Haoli Bai, Jingwen Leng, Bo Jiang
2025ICCADSLTarch: Towards Scalable Point-Based Neural Rendering by Taming Workload Imbalance and Memory Irregularity.Xingyang Li, Jie Jiang, Yu Feng, Yiming Gan, Jieru Zhao, Zihan Liu, Jingwen Leng, Minyi Guo
2025ICMLAn Efficient Private GPT Never Autoregressively Decodes.Zhengyi Li, Yue Guan, Kang Yang, Yu Feng, Ning Liu, Yu Yu, Jingwen Leng, Minyi Guo
2025IJCAITreeKV: Smooth Key-Value Cache Compression with Tree Structures.Ziwei He, Jian Yuan, Haoli Bai, Jingwen Leng, Bo Jiang
2025ISCALumina: Real-Time Neural Rendering by Exploiting Computational Redundancy.Yu Feng, Weikai Lin, Yuge Cheng, Zihan Liu, Jingwen Leng, Minyi Guo, Chen Chen, Shixuan Sun, Yuhao Zhu
2025ISLPEDRepurpose Accel-Sim for Next Generation NVIDIA Jetson GPU Architectural Design.Tianhao Huang, Lingyu Sun, Chao Li, Xiaofeng Hou, Yaqian Zhao, Jingwen Leng, Li Li, Minyi Guo
2025MICRORasengan: A Transition Hamiltonian-based Approximation Algorithm for Solving Constrained Binary Optimization Problems.Qifan Jiang, Liqiang Lu, Debin Xiang, Tianyao Chu, Tianze Zhu, Jingwen Leng, Yun Liang, Xiaoming Sun, Jianwei Yin
2025MICROVegapunk: Accurate and Fast Decoding for Quantum LDPC Codes with Online Hierarchical Algorithm and Sparse Accelerator.Kaiwen Zhou, Liqiang Lu, Debin Xiang, Chenning Tao, Anbang Wu, Jingwen Leng, Fangxin Liu, Mingshuai Chen, Jianwei Yin
2025SCA Sample-Free Compilation Framework for Efficient Dynamic Tensor Computation.Yangjie Zhou, Honglin Zhu, Qian Qiu, Weihao Cui, Zihan Liu, Peng Chen, Mohamed Wahib, Cong Guo, Siyuan Feng, Jintao Meng, Haidong Lan, Jingwen Leng, Yun Lin, Jin Song Dong, Wenxi Zhu, Minwen Deng
2025SIGMODGES: High-Performance Graph Processing Engine and Service in Huawei.Sen Gao, Jianwen Zhao, Hao Zhang, Shixuan Sun, Chen Liang, Gongye Chen, Wenliang Zhang, Bo Ren, Chao Liu, Chenyi Zhang, Quan Chen, Chao Li, Jingwen Leng, Minyi Guo
2024ASPLOSGMLake: Efficient and Transparent GPU Memory Defragmentation for Large-scale DNN Training with Virtual Memory Stitching.Cong Guo, Rui Zhang, Jiale Xu, Jingwen Leng, Zihan Liu, Ziyu Huang, Minyi Guo, Hao Wu, Shouren Zhao, Junping Zhao, Ke Zhang
2024ASPLOSMAGIS: Memory Optimization via Coordinated Graph Transformation and Scheduling for DNN.Renze Chen, Zijian Ding, Size Zheng, Chengrui Zhang, Jingwen Leng, Xuanzhe Liu, Yun Liang
2024ASPLOSAmanda: Unified Instrumentation Framework for Deep Neural Networks.Yue Guan, Yuxian Qiu, Jingwen Leng, Fan Yang, Shuo Yu, Yunxin Liu, Yu Feng, Yuhao Zhu, Lidong Zhou, Yun Liang, Chen Zhang, Chao Li, Minyi Guo
2024ASPLOSFractal: Joint Multi-Level Sparse Pattern Tuning of Accuracy and Performance for DNN Pruning.Yue Guan, Changming Yu, Yangjie Zhou, Jingwen Leng, Chao Li, Minyi Guo
2024ASPLOSJUNO: Optimizing High-Dimensional Approximate Nearest Neighbour Search with Sparsity-Aware Algorithm and Ray-Tracing Core Mapping.Zihan Liu, Wentao Ni, Jingwen Leng, Yu Feng, Cong Guo, Quan Chen, Chao Li, Minyi Guo, Yuhao Zhu
2024ICASSPFovea Transformer: Efficient Long-Context Modeling with Structured Fine-To-Coarse Attention.Ziwei He, Jian Yuan, Le Zhou, Jingwen Leng, Bo Jiang
2024ICCDSHEEO: Continuous Energy Efficiency Optimization in Autonomous Embedded Systems.Xinkai Wang, Chao Li, Lingyu Sun, Qizheng Lyu, Xiaofeng Hou, Jingwen Leng, Minyi Guo
2024ISCACicero: Addressing Algorithmic and Architectural Bottlenecks in Neural Rendering by Radiance Warping and Memory Optimizations.Yu Feng, Zihan Liu, Jingwen Leng, Minyi Guo, Yuhao Zhu
2024ISCAA Tale of Two Domains: Exploring Efficient Architecture Design for Truly Autonomous Things.Xiaofeng Hou, Tongqiao Xu, Chao Li, Cheng Xu, Jiacheng Liu, Yang Hu, Jieru Zhao, Jingwen Leng, Kwang-Ting Cheng, Minyi Guo
2023ACLFourier Transformer: Fast Long Range Modeling by Removing Sequence Redundancy with FFT Operator.Ziwei He, Meng Yang, Minwei Feng, Jingcheng Yin, Xinbing Wang, Jingwen Leng, Zhouhan Lin
2023ASPLOSuGrapher: High-Performance Graph Operator Computation via Unified Abstraction for Graph Neural Networks.Yangjie Zhou, Jingwen Leng, Yaoxu Song, Shuwen Lu, Mian Wang, Chao Li, Minyi Guo, Wenting Shen, Yong Li, Wei Lin, Xiangwen Liu, Hanqing Wu
2023CLOUDNot All Resources are Visible: Exploiting Fragmented Shadow Resources in Shared-State Scheduler Architecture.Xinkai Wang, Hao He, Yuancheng Li, Chao Li, Xiaofeng Hou, Jing Wang, Quan Chen, Jingwen Leng, Minyi Guo, Leibo Wang
2023HPCAChimera: An Analytical Optimizing Framework for Effective Compute-intensive Operators Fusion.Size Zheng, Siyuan Chen, Peidi Song, Renze Chen, Xiuhong Li, Shengen Yan, Dahua Lin, Jingwen Leng, Yun Liang
2023ISCAOliVe: Accelerating Large Language Models via Hardware-friendly Outlier-Victim Pair Quantization.Cong Guo, Jiaming Tang, Weiming Hu, Jingwen Leng, Chen Zhang, Fan Yang, Yunxin Liu, Minyi Guo, Yuhao Zhu
2023ISCAImaGen: A General Framework for Generating Memory- and Power-Efficient Image Processing Accelerators.Nisarg Ujjainkar, Jingwen Leng, Yuhao Zhu
2023ICSPAC: Preference-Aware Co-location Scheduling on Heterogeneous NUMA Architectures To Improve Resource Utilization.Pu Pang, Yaoxuan Li, Bo Liu, Quan Chen, Zhou Yu, Zhibin Yu, Deze Zeng, Jingwen Leng, Jieru Zhao, Minyi Guo
2022AAAIBlock-Skim: Efficient Question Answering for Transformer.Yue Guan, Zhengyi Li, Zhouhan Lin, Yuhao Zhu, Jingwen Leng, Minyi Guo
2022ACLTranskimmer: Transformer Learns to Layer-wise Skim.Yue Guan, Zhengyi Li, Jingwen Leng, Zhouhan Lin, Minyi Guo
2022ASPLOSVELTAIR: towards high-performance multi-tenant deep learning services via adaptive compilation and scheduling.Zihan Liu, Jingwen Leng, Zhihui Zhang, Quan Chen, Chao Li, Minyi Guo
2022ASPLOSAstraea: towards QoS-aware and resource-efficient multi-stage GPU services.Wei Zhang, Quan Chen, Kaihua Fu, Ningxin Zheng, Zhiyi Huang, Jingwen Leng, Minyi Guo
2022DACEMS: efficient memory subsystem synthesis for spatial accelerators.Liancheng Jia, Yuyue Wang, Jingwen Leng, Yun Liang
2022DACSALO: an efficient spatial accelerator enabling hybrid sparse attention mechanisms for long sequences.Guan Shen, Jieru Zhao, Quan Chen, Jingwen Leng, Chao Li, Minyi Guo
2022HPCATacker: Tensor-CUDA Core Kernel Fusion for Improving the GPU Utilization while Ensuring QoS.Han Zhao, Weihao Cui, Quan Chen, Youtao Zhang, Yanchao Lu, Chao Li, Jingwen Leng, Minyi Guo
2022ICCDNesting Forward Automatic Differentiation for Memory-Efficient Deep Neural Network Training.Cong Guo, Yuxian Qiu, Jingwen Leng, Chen Zhang, Ying Cao, Quanlu Zhang, Yunxin Liu, Fan Yang, Minyi Guo
2022ICLRSQuant: On-the-Fly Data-Free Quantization via Diagonal Hessian Approximation.Cong Guo, Yuxian Qiu, Jingwen Leng, Xiaotian Gao, Chen Zhang, Yunxin Liu, Fan Yang, Yuhao Zhu, Minyi Guo
2022ICSPAME: precision-aware multi-exit DNN serving for reducing latencies of batched inferences.Shulai Zhang, Weihao Cui, Quan Chen, Zhengnian Zhang, Yue Guan, Jingwen Leng, Chao Li, Minyi Guo
2022ISSREBraum: Analyzing and Protecting Autonomous Machine Software Stack.Yiming Gan, Paul N. Whatmough, Jingwen Leng, Bo Yu, Shaoshan Liu, Yuhao Zhu
2022MICROANT: Exploiting Adaptive Numerical Data Type for Low-bit Deep Neural Network Quantization.Cong Guo, Chen Zhang, Jingwen Leng, Zihan Liu, Fan Yang, Yunxin Liu, Minyi Guo, Yuhao Zhu
2021ICCDExploiting Intra-SM Parallelism in GPUs via Persistent and Elastic Blocks.Han Zhao, Weihao Cui, Quan Chen, Jieru Zhao, Jingwen Leng, Minyi Guo
2021ICPPDubhe: Towards Data Unbiasedness with Homomorphic Encryption in Federated Learning Client Selection.Shulai Zhang, Zirui Li, Quan Chen, Wenli Zheng, Jingwen Leng, Minyi Guo
2021ISCADual-side Sparse Tensor Core.Yang Wang, Chen Zhang, Zhiqiang Xie, Cong Guo, Yunxin Liu, Jingwen Leng
2021SCEnable simultaneous DNN services based on deterministic operator overlap and precise latency prediction.Weihao Cui, Han Zhao, Quan Chen, Ningxin Zheng, Jingwen Leng, Jieru Zhao, Zhuo Song, Tao Ma, Yong Yang, Chao Li, Minyi Guo
2020COLINGHow Far Does BERT Look At: Distance-based Clustering and Analysis of BERT's Attention.Yue Guan, Jingwen Leng, Chao Li, Quan Chen, Minyi Guo
2020DACBalancing Efficiency and Flexibility for DNN Acceleration via Temporal GPU-Systolic Array Integration.Cong Guo, Yangjie Zhou, Jingwen Leng, Yuhao Zhu, Zidong Du, Quan Chen, Chao Li, Bin Yao, Minyi Guo
2020HPCAAsymmetric Resilience: Exploiting Task-Level Idempotency for Transient Error Recovery in Accelerator-Based Systems.Jingwen Leng, Alper Buyuktosunoglu, Ramon Bertran, Pradip Bose, Quan Chen, Minyi Guo, Vijay Janapa Reddi
2020ICDCSCODA: Improving Resource Utilization by Slimming and Co-locating DNN and CPU Jobs.Han Zhao, Weihao Cui, Quan Chen, Jingwen Leng, Kai Yu, Deze Zeng, Chao Li, Minyi Guo
2020ICPPURSA: Precise Capacity Planning and Fair Scheduling based on Low-level Statistics for Public Clouds.Wei Zhang, Ningxin Zheng, Quan Chen, Yong Yang, Zhuo Song, Tao Ma, Jingwen Leng, Minyi Guo
2020ICPPOVERSEE: Outsourcing Verification to Enable Resource Sharing in Edge Environment.Xiaoqing Cai, Jiuchen Shi, Rui Yuan, Chang Liu, Wenli Zheng, Quan Chen, Chao Li, Jingwen Leng, Minyi Guo
2020ISPADLFusion: An Auto-Tuning Compiler for Layer Fusion on Deep Neural Network Accelerator.Zihan Liu, Jingwen Leng, Quan Chen, Chao Li, Wenli Zheng, Li Li, Minyi Guo
2020MICROPtolemy: Architecture Support for Robust Deep Learning.Yiming Gan, Yuxian Qiu, Jingwen Leng, Minyi Guo, Yuhao Zhu
2020SCAccelerating sparse DNN models without hardware-support via tile-wise sparsity.Cong Guo, Bo Yang Hsueh, Jingwen Leng, Yuxian Qiu, Yue Guan, Zehuan Wang, Xiaoying Jia, Xipeng Li, Minyi Guo, Yuhao Zhu
2019CVPRAdversarial Defense Through Network Profiling Based Path Extraction.Yuxian Qiu, Jingwen Leng, Cong Guo, Quan Chen, Chao Li, Minyi Guo, Yuhao Zhu
2019ICCDEbird: Elastic Batch for Improving Responsiveness and Throughput of Deep Learning Services.Weihao Cui, Mengze Wei, Quan Chen, Xiaoxin Tang, Jingwen Leng, Li Li, Mingyi Guo
2019IOLTSModern Hardware Margins: CPUs, GPUs, FPGAs Recent System-Level Studies.Dimitris Gizopoulos, George Papadimitriou, Athanasios Chatzidimitriou, Vijay Janapa Reddi, Behzad Salami, Osman S. Unsal, Adrin Cristal Kestelman, Jingwen Leng
2019ICSAvalon: towards QoS awareness and improved utilization through multi-resource management in datacenters.Quan Chen, Zhenning Wang, Jingwen Leng, Chao Li, Wenli Zheng, Minyi Guo
2019NPCCharacterizing Perception Module Performance and Robustness in Production-Scale Autonomous Driving System.Alessandro Toschi, Mustafa Sanic, Jingwen Leng, Quan Chen, Chunlin Wang, Minyi Guo
2018DACEfficient and reliable power delivery in voltage-stacked manycore system with hybrid charge-recycling regulators.An Zou, Jingwen Leng, Xin He, Yazhou Zu, Vijay Janapa Reddi, Xuan Zhang
2018ICCDDR DRAM: Accelerating Memory-Read-Intensive Applications.Yuhai Cao, Chao Li, Quan Chen, Jingwen Leng, Minyi Guo, Jing Wang, Weigong Zhang
2018MICROVoltage-Stacked GPUs: A Control Theory Driven Cross-Layer Solution for Practical Voltage Stacking in GPUs.An Zou, Jingwen Leng, Xin He, Yazhou Zu, Christopher D. Gill, Vijay Janapa Reddi, Xuan Zhang
2017DACIvory: Early-Stage Design Space Exploration Tool for Integrated Voltage Regulators.An Zou, Jingwen Leng, Yazhou Zu, Tao Tong, Vijay Janapa Reddi, David M. Brooks, Gu-Yeon Wei, Xuan Zhang
2015HPCAGPU voltage noise: Characterization and hierarchical smoothing of spatial and temporal voltage noise interference in GPU architectures.Jingwen Leng, Yazhou Zu, Vijay Janapa Reddi
2015MICROSafe limits on voltage reduction efficiency in GPUs: a direct measurement approach.Jingwen Leng, Alper Buyuktosunoglu, Ramon Bertran, Pradip Bose, Vijay Janapa Reddi
2015MICROAdaptive guardband scheduling to improve system-level efficiency of the POWER7+.Yazhou Zu, Charles R. Lefurgy, Jingwen Leng, Matthew Halpern, Michael S. Floyd, Vijay Janapa Reddi
2014ISLPEDGPUVolt: modeling and characterizing voltage noise in GPU architectures.Jingwen Leng, Yazhou Zu, Minsoo Rhu, Meeta Sharma Gupta, Vijay Janapa Reddi
2013ISCAGPUWattch: enabling energy optimizations in GPGPUs.Jingwen Leng, Tayler H. Hetherington, Ahmed ElTantawy, Syed Zohaib Gilani, Nam Sung Kim, Tor M. Aamodt, Vijay Janapa Reddi
2013MICROA locality-aware memory hierarchy for energy-efficient GPU architectures.Minsoo Rhu, Michael B. Sullivan, Jingwen Leng, Mattan Erez