| 2022 | MARTA: Multi-configuration Assembly pRofiler and Toolkit for performance Analysis. | Marcos Horro, Louis-Nol Pouchet, Gabriel Rodrguez, Juan Tourio |
| 2022 | Ruby: Improving Hardware Efficiency for Tensor Algebra Accelerators Through Imperfect Factorization. | Mark Horeni, Pooria Taheri, Po-An Tsai, Angshuman Parashar, Joel S. Emer, Siddharth Joshi |
| 2022 | OS-level Implications of Using DRAM Caches in Memory Disaggregation. | Bin Gao, Hao-Wei Tee, Alireza Sanaee, Soh Boon Jun, Djordje Jevdjic |
| 2022 | DRAM Bandwidth and Latency Stacks: Visualizing DRAM Bottlenecks. | Stijn Eyerman, Wim Heirman, Ibrahim Hur |
| 2022 | SAPCo Sort: optimizing Degree-Ordering for Power-Law Graphs. | Mohsen Koohi Esfahani, Peter Kilpatrick, Hans Vandierendonck |
| 2022 | Meterstick: Benchmarking Performance Variability in Cloud and Self-hosted Minecraft-like Games. | Jerrit Eickhoff, Jesse Donkervliet, Alexandru Iosup |
| 2022 | GPUCalorie: Floorplan Estimation for GPU Thermal Evaluation. | Marcus Chow, Ali Jahanshahi, Ana Cardenas Beltran, Sheldon X.-D. Tan, Daniel Wong |
| 2022 | ARBench: Augmented Reality Benchmark For Mobile Devices. | Sofiane Chetoui, Rahul Shahi, Seif Abdelaziz, Abhinav Golas, Farrukh Hijaz, Sherief Reda |
| 2022 | Distilling the Real Cost of Production Garbage Collectors. | Zixian Cai, Stephen M. Blackburn, Michael D. Bond, Martin Maas |
| 2022 | Benchmarking Test-Time Unsupervised Deep Neural Network Adaptation on Edge Devices. | Kshitij Bhardwaj, James Diffenderfer, Bhavya Kailkhura, Maya B. Gokhale |
| 2022 | Pareto Rank Surrogate Model for Hardware-aware Neural Architecture Search. | Hadjer Benmeziane, Smal Niar, Hamza Ouarnoughi, Kaoutar El Maghraoui |
| 2022 | RTRBench: A Benchmark Suite for Real-Time Robotics. | Mohammad Bakhshalipour, Maxim Likhachev, Phillip B. Gibbons |
| 2022 | A SIMT Analyzer for Multi-Threaded CPU Applications. | Ahmad Alawneh, Mahmoud Khairy, Timothy G. Rogers |
| 2022 | FOURST: A code generator for FFT-based fast stencil computations. | Zafar Ahmad, Mohammad Mahdi Javanmard, Gregory Thomas Croisdale, Aaron Gregory, Pramod Ganapathi, Louis-Nol Pouchet, Rezaul Chowdhury |
| 2022 | XFeatur: Hardware Feature Extraction for DNN Auto-tuning. | Jorge Sierra Acosta, Andreas Diavastos, Antonio Gonzlez |
| 2021 | COBRA: A Framework for Evaluating Compositions of Hardware Branch Predictors. | Jerry Zhao, Abraham Gonzalez, Alon Amid, Sagar Karandikar, Krste Asanovic |
| 2021 | Reducing BERT Computation by Padding Removal and Curriculum Learning. | Wei Zhang, Wei Wei, Wen Wang, Lingling Jin, Zheng Cao |
| 2021 | Characterizing Massively Parallel Polymorphism. | Mengchi Zhang, Ahmad Alawneh, Timothy G. Rogers |
| 2021 | Loopapalooza: Investigating Limits of Loop-Level Parallelism with a Compiler-Driven Approach. | Ali Mustafa Zaidi, Konstantinos Iordanou, Mikel Lujn, Giacomo Gabrielli |
| 2021 | Analyzing Secure Memory Architecture for GPUs. | Shougang Yuan, Ardhi Wiratama Baskara Yudha, Yan Solihin, Huiyang Zhou |
| 2021 | Memory-Efficient Hardware Performance Counters with Approximate-Counting Algorithms. | Jingyi Xu, Sehoon Kim, Borivoje Nikolic, Yakun Sophia Shao |
| 2021 | Sparseloop: An Analytical, Energy-Focused Design Space Exploration Methodology for Sparse Tensor Accelerators. | Yannan Nellie Wu, Po-An Tsai, Angshuman Parashar, Vivienne Sze, Joel S. Emer |
| 2021 | Performance Analysis of Graph Neural Network Frameworks. | Junwei Wu, Jingwei Sun, Hao Sun, Guangzhong Sun |
| 2021 | TPUPoint: Automatic Characterization of Hardware-Accelerated Machine-Learning Behavior for Cloud Computing. | Abenezer Wudenhe, Hung-Wei Tseng |
| 2021 | Architecture-Level Energy Estimation for Heterogeneous Computing Systems. | Francis Wang, Yannan Nellie Wu, Matthew E. Woicik, Joel S. Emer, Vivienne Sze |