| 2024 | FIGNA: Integer Unit-Based Accelerator Design for FP-INT GEMM Preserving Numerical Accuracy. | Jaeyong Jang, Yulhwa Kim, Juheun Lee, Jae-Joon Kim |
| 2024 | A Two Level Neural Approach Combining Off-Chip Prediction with Adaptive Prefetch Filtering. | Alexandre Valentin Jamet, Georgios Vavouliotis, Daniel A. Jimnez, Lluc Alvarez, Marc Casas |
| 2024 | LUTein: Dense-Sparse Bit-Slice Architecture With Radix-4 LUT-Based Slice-Tensor Processing Units. | Dongseok Im, Hoi-Jun Yoo |
| 2024 | Pathfinding Future PIM Architectures by Demystifying a Commercial PIM Technology. | Bongjoon Hyun, Taehun Kim, Dongjae Lee, Minsoo Rhu |
| 2024 | MOPED: Efficient Motion Planning Engine with Flexible Dimension Support. | Lingyi Huang, Yu Gong, Yang Sui, Xiao Zang, Bo Yuan |
| 2024 | Bandwidth-Effective DRAM Cache for GPU s with Storage-Class Memory. | Jeongmin Hong, Sungjun Cho, Geonwoo Park, Wonhyuk Yang, Young-Ho Gong, Gwangsun Kim |
| 2024 | PruneGNN: Algorithm-Architecture Pruning Framework for Graph Neural Network Acceleration. | Deniz Gurevin, Mohsin Shan, Shaoyi Huang, Md Amit Hasan, Caiwen Ding, Omer Khan |
| 2024 | RELIEF: Relieving Memory Pressure In SoCs Via Data Movement-Aware Accelerator Scheduling. | Sudhanshu Gupta, Sandhya Dwarkadas |
| 2024 | DockerSSD: Containerized In-Storage Processing and Hardware Acceleration for Computational SSDs. | Donghyun Gouk, Miryeong Kwon, Hanyeoreum Bae, Myoungsoo Jung |
| 2024 | HotTiles: Accelerating SpMM with Heterogeneous Accelerator Architectures. | Gerasimos Gerogiannis, Sriram Aananthakrishnan, Josep Torrellas, Ibrahim Hur |
| 2024 | Differential-Matching Prefetcher for Indirect Memory Access. | Gelin Fu, Tian Xia, Zhongpei Luo, Ruiyang Chen, Wenzhe Zhao, Pengju Ren |
| 2024 | WASP: Exploiting GPU Pipeline Parallelism with Hardware-Accelerated Automatic Warp Specialization. | Neal Clayton Crago, Sana Damani, Karthikeyan Sankaralingam, Stephen W. Keckler |
| 2024 | RiF: Improving Read Performance of Modern SSDs Using an On-Die Early-Retry Engine. | Myoungjun Chun, Jaeyong Lee, Myungsuk Kim, Jisung Park, Jihong Kim |
| 2024 | Unleashing the Potential of PIM: Accelerating Large Batched Inference of Transformer-Based Generative Models. | Jaewan Choi, Jaehyun Park, Kwanhee Kyung, Nam Sung Kim, Jung Ho Ahn |
| 2024 | PREFETCHX: Cross-Core Cache-Agnostic Prefetcher-based Side-Channel Attacks. | Yun Chen, Ali Hajiabadi, Lingfeng Pei, Trevor E. Carlson |
| 2024 | GADGETSPINNER: A New Transient Execution Primitive Using the Loop Stream Detector. | Yun Chen, Ali Hajiabadi, Trevor E. Carlson |
| 2024 | Gem5-MARVEL: Microarchitecture-Level Resilience Analysis of Heterogeneous SoC Architectures. | Odysseas Chatzopoulos, George Papadimitriou, Vasileios Karakostas, Dimitris Gizopoulos |
| 2024 | Gemini: Mapping and Architecture Co-exploration for Large-scale DNN Chiplet Accelerators. | Jingwei Cai, Zuotong Wu, Sen Peng, Yuchen Wei, Zhanhong Tan, Guiming Shi, Mingyu Gao, Kaisheng Ma |
| 2024 | Enterprise-Class Cache Compression Design. | Alper Buyuktosunoglu, David Trilla, Blent Abali, Deanna Postles Dunn Berger, Craig R. Walters, Jang-Soo Lee |
| 2024 | FlipBit: Approximate Flash Memory for IoT Devices. | Alexander Buck, Karthik Ganesan, Natalie Enright Jerger |
| 2024 | CoMeT: Count-Min-Sketch-based Row Tracking to Mitigate RowHammer at Low Cost. | F. Nisa Bostanci, Ismail Emir Yksel, Ataberk Olgun, Konstantinos Kanellopoulos, Yahya Can Tugrul, A. Giray Yagliki, Mohammad Sadrosadati, Onur Mutlu |
| 2024 | Prosper: Program Stack Persistence in Hybrid Memory Systems. | K. P. Arun, Debadatta Mishra, Biswabandan Panda |
| 2024 | StreamPIM: Streaming Matrix Computation in Racetrack Memory. | Yuda An, Yunxiao Tang, Shushu Yi, Li Peng, Xiurui Pan, Guangyu Sun, Zhaochu Luo, Qiao Li, Jie Zhang |
| 2024 | Salus: Efficient Security Support for CXL-Expanded GPU Memory. | Rahaf Abdullah, Hyokeun Lee, Huiyang Zhou, Amro Awad |
| 2023 | FxHENN: FPGA-based acceleration framework for homomorphic encrypted CNN inference. | Yilan Zhu, Xinyao Wang, Lei Ju, Shanqing Guo |