Jingwen Leng
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
83
Venues
27
Active years
2013–2026
Best venue rank
A*
Where they publish
- A*ASPLOS12 papers
- A*HPCA10 papers
- A*ISCA9 papers
- A*MICRO8 papers
- A*DAC6 papers
- A*ACL5 papers
- CICCD5 papers
- ASC3 papers
- AICS3 papers
- BICPP3 papers
- MulticonferenceICASSP2 papers
- AISLPED2 papers
- AHPDC1 paper
- AICCAD1 paper
- A*ICML1 paper
- A*IJCAI1 paper
- A*SIGMOD1 paper
- BCLOUD1 paper
- A*AAAI1 paper
- A*ICLR1 paper
- AISSRE1 paper
- BCOLING1 paper
- AICDCS1 paper
- CISPA1 paper
- A*CVPR1 paper
- CIOLTS1 paper
- CNPC1 paper
Papers
83 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | On the (In-)Security of the Shuffling Defense in the Transformer Secure Inference. | Zhengyi Li, Yakai Wang, Jingwen Leng, Kang Yang, Yu Yu, Jiaping Gui, Yu Feng, Ning Liu, Minyi Guo |
| 2026 | ACL | CuBridge: An LLM-Based Framework for Understanding and Reconstructing High-Performance Attention Kernels. | Xing Ma, Yangjie Zhou, Wu Sun, Zihan Liu, Jingwen Leng, Yun Lin, Shixuan Sun, Minyi Guo, Jin Song Dong |
| 2026 | ASPLOS | M | Weiming Hu, Zihan Zhang, Haoyan Zhang, Chen Zhang, Cong Guo, Yu Feng, Tianchi Hu, Guanglin Li, Guipeng Hu, Junsong Wang, Jingwen Leng |
| 2026 | ASPLOS | Nebula: Infinite-Scale 3D Gaussian Splatting in VR via Collaborative Rendering and Accelerated Stereo Rasterization. | He Zhu, Zheng Liu, Xingyang Li, Anbang Wu, Jieru Zhao, Fangxin Liu, Yiming Gan, Jingwen Leng, Yu Feng |
| 2026 | HPCA | FlashFuser: Expanding the Scale of Kernel Fusion for Compute-Intensive Operators via Inter-Core Connection. | Ziyu Huang, Yangjie Zhou, Zihan Liu, Xinhao Luo, Yijia Diao, Minyi Guo, Jidong Zhai, Yu Feng, Chen Zhang, Anbang Wu, Jingwen Leng |
| 2026 | HPCA | SPLATONIC: Architectural Support for 3D Gaussian Splatting SLAM via Sparse Processing. | Xiaotong Huang, He Zhu, Tianrui Ma, Yuxiang Xiong, Fangxin Liu, Zhezhi He, Yiming Gan, Zihan Liu, Jingwen Leng, Yu Feng, Minyi Guo |
| 2026 | HPCA | CLINE: Improving Control Flow Compilation of Quantum Programs with Control Line Encoding. | Anbang Wu, Liqiang Lu, Jianwei Yin, Jingwen Leng, Minyi Guo |
| 2026 | HPCA | Towards Compute-Aware In-Switch Computing for LLMs Tensor-Parallelism on Multi-GPU Systems. | Chen Zhang, Qijun Zhang, Zhuoshan Zhou, Yijia Diao, Haibo Wang, Zhe Zhou, Zhipeng Tu, Zhiyao Li, Guangyu Sun, Zhuoran Song, Zhigang Ji, Jingwen Leng, Minyi Guo |
| 2026 | HPDC | FluxZK: Scalable and Efficient Zero-Knowledge Proof Computation via GPU Acceleration. | Xinwei Qiang, Liukun Yu, Xiyu Wang, Zhengyi Li, Shixuan Sun, Jingwen Leng, Chen Chen, Jiaping Gui, Zhenzhe Zheng, Jin Dong, Minyi Guo |
| 2026 | ISCA | Accelerating MoE with Dynamic In-Switch Computing on Multi-GPUs. | Qijun Zhang, Chen Zhang, Zhuoshan Zhou, Haibo Wang, Zhe Zhou, Zhipeng Tu, Guangyu Sun, Zhiyao Xie, Yijia Diao, Zhigang Ji, Jingwen Leng, Guanghui He, Minyi Guo |
| 2026 | ISCA | MoE-Hub: Taming Software Complexity for Seamless MoE Overlap with Hardware-Accelerated Communication on Multi-GPU Systems. | Zhuoshan Zhou, Chen Zhang, Shuyi Zhang, Qijun Zhang, Haibo Wang, Zhe Zhou, Zhipeng Tu, Guangyu Sun, Yijia Diao, Zhigang Ji, Jingwen Leng, Guanghui He, Minyi Guo |
| 2025 | ACL | Gumbel Reranking: Differentiable End-to-End Reranker Optimization. | Siyuan Huang, Zhiyuan Ma, Jintao Du, Changhua Meng, Weiqiang Wang, Jingwen Leng, Minyi Guo, Zhouhan Lin |
| 2025 | ASPLOS | Voyager: Input-Adaptive Algebraic Transformations for High-Performance Graph Neural Networks. | Yangjie Zhou, Wenting Shen, Jingwen Leng, Shuwen Lu, Zihan Liu, Weihao Cui, Zhendong Zhang, Wencong Xiao, Baole Ai, Yong Li, Wei Lin, Deze Zeng, Yun Liang, Quan Chen, Ning Liu, Minyi Guo |
| 2025 | ASPLOS | StreamGrid: Streaming Point Cloud Analytics via Compulsory Splitting and Deterministic Termination. | Yu Feng, Zheng Liu, Weikai Lin, Zihan Liu, Jingwen Leng, Minyi Guo, Zhezhi He, Jieru Zhao, Yuhao Zhu |
| 2025 | DAC | ArbiterQ: Improving QNN Convergency and Accuracy by Applying Personalized Model on Heterogeneous Quantum Devices. | Tianyao Chu, Siwei Tan, Liqiang Lu, Jingwen Leng, Fangxin Liu, Congliang Lang, Yifan Guo, Jianwei Yin |
| 2025 | HPCA | VQ-LLM: High-performance Code Generation for Vector Quantization Augmented LLM Inference. | Zihan Liu, Xinhao Luo, Junxian Guo, Wentao Ni, Yangjie Zhou, Yue Guan, Cong Guo, Weihao Cui, Yu Feng, Minyi Guo, Yuhao Zhu, Minjia Zhang, Chen Jin, Jingwen Leng |
| 2025 | HPCA | M-ANT: Efficient Low-bit Group Quantization for LLMs via Mathematically Adaptive Numerical Type. | Weiming Hu, Haoyan Zhang, Cong Guo, Yu Feng, Renyang Guan, Zhendong Hua, Zihan Liu, Yue Guan, Minyi Guo, Jingwen Leng |
| 2025 | ICASSP | WeightedKV: Attention Scores Weighted Key-Value Cache Merging for Large Language Models. | Jian Yuan, Ziwei He, Haoli Bai, Jingwen Leng, Bo Jiang |
| 2025 | ICCAD | SLTarch: Towards Scalable Point-Based Neural Rendering by Taming Workload Imbalance and Memory Irregularity. | Xingyang Li, Jie Jiang, Yu Feng, Yiming Gan, Jieru Zhao, Zihan Liu, Jingwen Leng, Minyi Guo |
| 2025 | ICML | An Efficient Private GPT Never Autoregressively Decodes. | Zhengyi Li, Yue Guan, Kang Yang, Yu Feng, Ning Liu, Yu Yu, Jingwen Leng, Minyi Guo |
| 2025 | IJCAI | TreeKV: Smooth Key-Value Cache Compression with Tree Structures. | Ziwei He, Jian Yuan, Haoli Bai, Jingwen Leng, Bo Jiang |
| 2025 | ISCA | Lumina: Real-Time Neural Rendering by Exploiting Computational Redundancy. | Yu Feng, Weikai Lin, Yuge Cheng, Zihan Liu, Jingwen Leng, Minyi Guo, Chen Chen, Shixuan Sun, Yuhao Zhu |
| 2025 | ISLPED | Repurpose Accel-Sim for Next Generation NVIDIA Jetson GPU Architectural Design. | Tianhao Huang, Lingyu Sun, Chao Li, Xiaofeng Hou, Yaqian Zhao, Jingwen Leng, Li Li, Minyi Guo |
| 2025 | MICRO | Rasengan: A Transition Hamiltonian-based Approximation Algorithm for Solving Constrained Binary Optimization Problems. | Qifan Jiang, Liqiang Lu, Debin Xiang, Tianyao Chu, Tianze Zhu, Jingwen Leng, Yun Liang, Xiaoming Sun, Jianwei Yin |
| 2025 | MICRO | Vegapunk: Accurate and Fast Decoding for Quantum LDPC Codes with Online Hierarchical Algorithm and Sparse Accelerator. | Kaiwen Zhou, Liqiang Lu, Debin Xiang, Chenning Tao, Anbang Wu, Jingwen Leng, Fangxin Liu, Mingshuai Chen, Jianwei Yin |
| 2025 | SC | A Sample-Free Compilation Framework for Efficient Dynamic Tensor Computation. | Yangjie Zhou, Honglin Zhu, Qian Qiu, Weihao Cui, Zihan Liu, Peng Chen, Mohamed Wahib, Cong Guo, Siyuan Feng, Jintao Meng, Haidong Lan, Jingwen Leng, Yun Lin, Jin Song Dong, Wenxi Zhu, Minwen Deng |
| 2025 | SIGMOD | GES: High-Performance Graph Processing Engine and Service in Huawei. | Sen Gao, Jianwen Zhao, Hao Zhang, Shixuan Sun, Chen Liang, Gongye Chen, Wenliang Zhang, Bo Ren, Chao Liu, Chenyi Zhang, Quan Chen, Chao Li, Jingwen Leng, Minyi Guo |
| 2024 | ASPLOS | GMLake: Efficient and Transparent GPU Memory Defragmentation for Large-scale DNN Training with Virtual Memory Stitching. | Cong Guo, Rui Zhang, Jiale Xu, Jingwen Leng, Zihan Liu, Ziyu Huang, Minyi Guo, Hao Wu, Shouren Zhao, Junping Zhao, Ke Zhang |
| 2024 | ASPLOS | MAGIS: Memory Optimization via Coordinated Graph Transformation and Scheduling for DNN. | Renze Chen, Zijian Ding, Size Zheng, Chengrui Zhang, Jingwen Leng, Xuanzhe Liu, Yun Liang |
| 2024 | ASPLOS | Amanda: Unified Instrumentation Framework for Deep Neural Networks. | Yue Guan, Yuxian Qiu, Jingwen Leng, Fan Yang, Shuo Yu, Yunxin Liu, Yu Feng, Yuhao Zhu, Lidong Zhou, Yun Liang, Chen Zhang, Chao Li, Minyi Guo |
| 2024 | ASPLOS | Fractal: Joint Multi-Level Sparse Pattern Tuning of Accuracy and Performance for DNN Pruning. | Yue Guan, Changming Yu, Yangjie Zhou, Jingwen Leng, Chao Li, Minyi Guo |
| 2024 | ASPLOS | JUNO: Optimizing High-Dimensional Approximate Nearest Neighbour Search with Sparsity-Aware Algorithm and Ray-Tracing Core Mapping. | Zihan Liu, Wentao Ni, Jingwen Leng, Yu Feng, Cong Guo, Quan Chen, Chao Li, Minyi Guo, Yuhao Zhu |
| 2024 | ICASSP | Fovea Transformer: Efficient Long-Context Modeling with Structured Fine-To-Coarse Attention. | Ziwei He, Jian Yuan, Le Zhou, Jingwen Leng, Bo Jiang |
| 2024 | ICCD | SHEEO: Continuous Energy Efficiency Optimization in Autonomous Embedded Systems. | Xinkai Wang, Chao Li, Lingyu Sun, Qizheng Lyu, Xiaofeng Hou, Jingwen Leng, Minyi Guo |
| 2024 | ISCA | Cicero: Addressing Algorithmic and Architectural Bottlenecks in Neural Rendering by Radiance Warping and Memory Optimizations. | Yu Feng, Zihan Liu, Jingwen Leng, Minyi Guo, Yuhao Zhu |
| 2024 | ISCA | A Tale of Two Domains: Exploring Efficient Architecture Design for Truly Autonomous Things. | Xiaofeng Hou, Tongqiao Xu, Chao Li, Cheng Xu, Jiacheng Liu, Yang Hu, Jieru Zhao, Jingwen Leng, Kwang-Ting Cheng, Minyi Guo |
| 2023 | ACL | Fourier Transformer: Fast Long Range Modeling by Removing Sequence Redundancy with FFT Operator. | Ziwei He, Meng Yang, Minwei Feng, Jingcheng Yin, Xinbing Wang, Jingwen Leng, Zhouhan Lin |
| 2023 | ASPLOS | uGrapher: High-Performance Graph Operator Computation via Unified Abstraction for Graph Neural Networks. | Yangjie Zhou, Jingwen Leng, Yaoxu Song, Shuwen Lu, Mian Wang, Chao Li, Minyi Guo, Wenting Shen, Yong Li, Wei Lin, Xiangwen Liu, Hanqing Wu |
| 2023 | CLOUD | Not All Resources are Visible: Exploiting Fragmented Shadow Resources in Shared-State Scheduler Architecture. | Xinkai Wang, Hao He, Yuancheng Li, Chao Li, Xiaofeng Hou, Jing Wang, Quan Chen, Jingwen Leng, Minyi Guo, Leibo Wang |
| 2023 | HPCA | Chimera: An Analytical Optimizing Framework for Effective Compute-intensive Operators Fusion. | Size Zheng, Siyuan Chen, Peidi Song, Renze Chen, Xiuhong Li, Shengen Yan, Dahua Lin, Jingwen Leng, Yun Liang |
| 2023 | ISCA | OliVe: Accelerating Large Language Models via Hardware-friendly Outlier-Victim Pair Quantization. | Cong Guo, Jiaming Tang, Weiming Hu, Jingwen Leng, Chen Zhang, Fan Yang, Yunxin Liu, Minyi Guo, Yuhao Zhu |
| 2023 | ISCA | ImaGen: A General Framework for Generating Memory- and Power-Efficient Image Processing Accelerators. | Nisarg Ujjainkar, Jingwen Leng, Yuhao Zhu |
| 2023 | ICS | PAC: Preference-Aware Co-location Scheduling on Heterogeneous NUMA Architectures To Improve Resource Utilization. | Pu Pang, Yaoxuan Li, Bo Liu, Quan Chen, Zhou Yu, Zhibin Yu, Deze Zeng, Jingwen Leng, Jieru Zhao, Minyi Guo |
| 2022 | AAAI | Block-Skim: Efficient Question Answering for Transformer. | Yue Guan, Zhengyi Li, Zhouhan Lin, Yuhao Zhu, Jingwen Leng, Minyi Guo |
| 2022 | ACL | Transkimmer: Transformer Learns to Layer-wise Skim. | Yue Guan, Zhengyi Li, Jingwen Leng, Zhouhan Lin, Minyi Guo |
| 2022 | ASPLOS | VELTAIR: towards high-performance multi-tenant deep learning services via adaptive compilation and scheduling. | Zihan Liu, Jingwen Leng, Zhihui Zhang, Quan Chen, Chao Li, Minyi Guo |
| 2022 | ASPLOS | Astraea: towards QoS-aware and resource-efficient multi-stage GPU services. | Wei Zhang, Quan Chen, Kaihua Fu, Ningxin Zheng, Zhiyi Huang, Jingwen Leng, Minyi Guo |
| 2022 | DAC | EMS: efficient memory subsystem synthesis for spatial accelerators. | Liancheng Jia, Yuyue Wang, Jingwen Leng, Yun Liang |
| 2022 | DAC | SALO: an efficient spatial accelerator enabling hybrid sparse attention mechanisms for long sequences. | Guan Shen, Jieru Zhao, Quan Chen, Jingwen Leng, Chao Li, Minyi Guo |
| 2022 | HPCA | Tacker: Tensor-CUDA Core Kernel Fusion for Improving the GPU Utilization while Ensuring QoS. | Han Zhao, Weihao Cui, Quan Chen, Youtao Zhang, Yanchao Lu, Chao Li, Jingwen Leng, Minyi Guo |
| 2022 | ICCD | Nesting Forward Automatic Differentiation for Memory-Efficient Deep Neural Network Training. | Cong Guo, Yuxian Qiu, Jingwen Leng, Chen Zhang, Ying Cao, Quanlu Zhang, Yunxin Liu, Fan Yang, Minyi Guo |
| 2022 | ICLR | SQuant: On-the-Fly Data-Free Quantization via Diagonal Hessian Approximation. | Cong Guo, Yuxian Qiu, Jingwen Leng, Xiaotian Gao, Chen Zhang, Yunxin Liu, Fan Yang, Yuhao Zhu, Minyi Guo |
| 2022 | ICS | PAME: precision-aware multi-exit DNN serving for reducing latencies of batched inferences. | Shulai Zhang, Weihao Cui, Quan Chen, Zhengnian Zhang, Yue Guan, Jingwen Leng, Chao Li, Minyi Guo |
| 2022 | ISSRE | Braum: Analyzing and Protecting Autonomous Machine Software Stack. | Yiming Gan, Paul N. Whatmough, Jingwen Leng, Bo Yu, Shaoshan Liu, Yuhao Zhu |
| 2022 | MICRO | ANT: Exploiting Adaptive Numerical Data Type for Low-bit Deep Neural Network Quantization. | Cong Guo, Chen Zhang, Jingwen Leng, Zihan Liu, Fan Yang, Yunxin Liu, Minyi Guo, Yuhao Zhu |
| 2021 | ICCD | Exploiting Intra-SM Parallelism in GPUs via Persistent and Elastic Blocks. | Han Zhao, Weihao Cui, Quan Chen, Jieru Zhao, Jingwen Leng, Minyi Guo |
| 2021 | ICPP | Dubhe: Towards Data Unbiasedness with Homomorphic Encryption in Federated Learning Client Selection. | Shulai Zhang, Zirui Li, Quan Chen, Wenli Zheng, Jingwen Leng, Minyi Guo |
| 2021 | ISCA | Dual-side Sparse Tensor Core. | Yang Wang, Chen Zhang, Zhiqiang Xie, Cong Guo, Yunxin Liu, Jingwen Leng |
| 2021 | SC | Enable simultaneous DNN services based on deterministic operator overlap and precise latency prediction. | Weihao Cui, Han Zhao, Quan Chen, Ningxin Zheng, Jingwen Leng, Jieru Zhao, Zhuo Song, Tao Ma, Yong Yang, Chao Li, Minyi Guo |
| 2020 | COLING | How Far Does BERT Look At: Distance-based Clustering and Analysis of BERT's Attention. | Yue Guan, Jingwen Leng, Chao Li, Quan Chen, Minyi Guo |
| 2020 | DAC | Balancing Efficiency and Flexibility for DNN Acceleration via Temporal GPU-Systolic Array Integration. | Cong Guo, Yangjie Zhou, Jingwen Leng, Yuhao Zhu, Zidong Du, Quan Chen, Chao Li, Bin Yao, Minyi Guo |
| 2020 | HPCA | Asymmetric Resilience: Exploiting Task-Level Idempotency for Transient Error Recovery in Accelerator-Based Systems. | Jingwen Leng, Alper Buyuktosunoglu, Ramon Bertran, Pradip Bose, Quan Chen, Minyi Guo, Vijay Janapa Reddi |
| 2020 | ICDCS | CODA: Improving Resource Utilization by Slimming and Co-locating DNN and CPU Jobs. | Han Zhao, Weihao Cui, Quan Chen, Jingwen Leng, Kai Yu, Deze Zeng, Chao Li, Minyi Guo |
| 2020 | ICPP | URSA: Precise Capacity Planning and Fair Scheduling based on Low-level Statistics for Public Clouds. | Wei Zhang, Ningxin Zheng, Quan Chen, Yong Yang, Zhuo Song, Tao Ma, Jingwen Leng, Minyi Guo |
| 2020 | ICPP | OVERSEE: Outsourcing Verification to Enable Resource Sharing in Edge Environment. | Xiaoqing Cai, Jiuchen Shi, Rui Yuan, Chang Liu, Wenli Zheng, Quan Chen, Chao Li, Jingwen Leng, Minyi Guo |
| 2020 | ISPA | DLFusion: An Auto-Tuning Compiler for Layer Fusion on Deep Neural Network Accelerator. | Zihan Liu, Jingwen Leng, Quan Chen, Chao Li, Wenli Zheng, Li Li, Minyi Guo |
| 2020 | MICRO | Ptolemy: Architecture Support for Robust Deep Learning. | Yiming Gan, Yuxian Qiu, Jingwen Leng, Minyi Guo, Yuhao Zhu |
| 2020 | SC | Accelerating sparse DNN models without hardware-support via tile-wise sparsity. | Cong Guo, Bo Yang Hsueh, Jingwen Leng, Yuxian Qiu, Yue Guan, Zehuan Wang, Xiaoying Jia, Xipeng Li, Minyi Guo, Yuhao Zhu |
| 2019 | CVPR | Adversarial Defense Through Network Profiling Based Path Extraction. | Yuxian Qiu, Jingwen Leng, Cong Guo, Quan Chen, Chao Li, Minyi Guo, Yuhao Zhu |
| 2019 | ICCD | Ebird: Elastic Batch for Improving Responsiveness and Throughput of Deep Learning Services. | Weihao Cui, Mengze Wei, Quan Chen, Xiaoxin Tang, Jingwen Leng, Li Li, Mingyi Guo |
| 2019 | IOLTS | Modern Hardware Margins: CPUs, GPUs, FPGAs Recent System-Level Studies. | Dimitris Gizopoulos, George Papadimitriou, Athanasios Chatzidimitriou, Vijay Janapa Reddi, Behzad Salami, Osman S. Unsal, Adrin Cristal Kestelman, Jingwen Leng |
| 2019 | ICS | Avalon: towards QoS awareness and improved utilization through multi-resource management in datacenters. | Quan Chen, Zhenning Wang, Jingwen Leng, Chao Li, Wenli Zheng, Minyi Guo |
| 2019 | NPC | Characterizing Perception Module Performance and Robustness in Production-Scale Autonomous Driving System. | Alessandro Toschi, Mustafa Sanic, Jingwen Leng, Quan Chen, Chunlin Wang, Minyi Guo |
| 2018 | DAC | Efficient and reliable power delivery in voltage-stacked manycore system with hybrid charge-recycling regulators. | An Zou, Jingwen Leng, Xin He, Yazhou Zu, Vijay Janapa Reddi, Xuan Zhang |
| 2018 | ICCD | DR DRAM: Accelerating Memory-Read-Intensive Applications. | Yuhai Cao, Chao Li, Quan Chen, Jingwen Leng, Minyi Guo, Jing Wang, Weigong Zhang |
| 2018 | MICRO | Voltage-Stacked GPUs: A Control Theory Driven Cross-Layer Solution for Practical Voltage Stacking in GPUs. | An Zou, Jingwen Leng, Xin He, Yazhou Zu, Christopher D. Gill, Vijay Janapa Reddi, Xuan Zhang |
| 2017 | DAC | Ivory: Early-Stage Design Space Exploration Tool for Integrated Voltage Regulators. | An Zou, Jingwen Leng, Yazhou Zu, Tao Tong, Vijay Janapa Reddi, David M. Brooks, Gu-Yeon Wei, Xuan Zhang |
| 2015 | HPCA | GPU voltage noise: Characterization and hierarchical smoothing of spatial and temporal voltage noise interference in GPU architectures. | Jingwen Leng, Yazhou Zu, Vijay Janapa Reddi |
| 2015 | MICRO | Safe limits on voltage reduction efficiency in GPUs: a direct measurement approach. | Jingwen Leng, Alper Buyuktosunoglu, Ramon Bertran, Pradip Bose, Vijay Janapa Reddi |
| 2015 | MICRO | Adaptive guardband scheduling to improve system-level efficiency of the POWER7+. | Yazhou Zu, Charles R. Lefurgy, Jingwen Leng, Matthew Halpern, Michael S. Floyd, Vijay Janapa Reddi |
| 2014 | ISLPED | GPUVolt: modeling and characterizing voltage noise in GPU architectures. | Jingwen Leng, Yazhou Zu, Minsoo Rhu, Meeta Sharma Gupta, Vijay Janapa Reddi |
| 2013 | ISCA | GPUWattch: enabling energy optimizations in GPGPUs. | Jingwen Leng, Tayler H. Hetherington, Ahmed ElTantawy, Syed Zohaib Gilani, Nam Sung Kim, Tor M. Aamodt, Vijay Janapa Reddi |
| 2013 | MICRO | A locality-aware memory hierarchy for energy-efficient GPU architectures. | Minsoo Rhu, Michael B. Sullivan, Jingwen Leng, Mattan Erez |