| 2017 | Towards more hardware-friendly deep learning. | Yoshua Bengio |
| 2017 | ObfusMem: A Low-Overhead Access Obfuscation for Trusted Memories. | Amro Awad, Yipeng Wang, Deborah Shands, Yan Solihin |
| 2017 | MCM-GPU: Multi-Chip-Module GPUs for Continued Performance Scalability. | Akhil Arunkumar, Evgeny Bolotin, Benjamin Y. Cho, Ugljesa Milic, Eiman Ebrahimi, Oreste Villa, Aamer Jaleel, Carole-Jean Wu, David W. Nellans |
| 2017 | HA2lloc: Hardware-Assisted Secure Allocator. | Orlando Arias, Dean Sullivan, Yier Jin |
| 2017 | LogCA: A High-Level Performance Model for Hardware Accelerators. | Muhammad Shoaib Bin Altaf, David A. Wood |
| 2017 | Do-It-Yourself Virtual Memory Translation. | Hanna Alam, Tianhao Zhang, Mattan Erez, Yoav Etsion |
| 2017 | InvisiMem: Smart Memory Defenses for Memory Bus Side Channel. | Shaizeen Aga, Satish Narayanasamy |
| 2017 | Parallel Automata Processor. | Arun Subramaniyan, Reetuparna Das |
| 2016 | MITTS: Memory Inter-arrival Time Traffic Shaping. | Yanqi Zhou, David Wentzlaff |
| 2016 | CASH: Supporting IaaS Customers with a Sub-core Configurable Architecture. | Yanqi Zhou, Henry Hoffmann, David Wentzlaff |
| 2016 | SoK: A Study of Using Hardware-assisted Isolated Execution Environments for Security. | Fengwei Zhang, Hongwei Zhang |
| 2016 | Mellow Writes: Extending Lifetime in Resistive Memories through Selective Slow Write Backs. | Lunkai Zhang, Brian Neely, Diana Franklin, Dmitri B. Strukov, Yuan Xie, Frederic T. Chong |
| 2016 | Treadmill: Attributing the Source of Tail Latency through Precise Load Testing and Statistical Inference. | Yunqi Zhang, David Meisner, Jason Mars, Lingjia Tang |
| 2016 | FAME: Fault-attack Aware Microprocessor Extensions for Hardware Fault Detection and Software Fault Response. | Bilgiday Yuce, Nahid Farhady Ghalaty, Chinmay Deshpande, Conor Patrick, Leyla Nazhandali, Patrick Schaumont |
| 2016 | Virtual Thread: Maximizing Thread-Level Parallelism beyond GPU Scheduling Limit. | Myung Kuk Yoon, Keunsoo Kim, Sangpil Lee, Won Woo Ro, Murali Annavaram |
| 2016 | Opportunistic Competition Overhead Reduction for Expediting Critical Section in NoC Based CMPs. | Yuan Yao, Zhonghai Lu |
| 2016 | Warped-Slicer: Efficient Intra-SM Slicing through Dynamic Resource Partitioning for GPU Multiprogramming. | Qiumin Xu, Hyeran Jeon, Keunsoo Kim, Won Woo Ro, Murali Annavaram |
| 2016 | Intel Software Guard Extensions (Intel SGX) Software Support for Dynamic Memory Allocation inside an Enclave. | Bin Cedric Xing, Mark Shanahan, Rebekah Leslie-Hurd |
| 2016 | Dynamo: Facebook's Data Center-Wide Power Management System. | Qiang Wu, Qingyuan Deng, Lakshmi Ganesh, Chang-Hong Hsu, Yun Jin, Sanjeev Kumar, Bin Li, Justin Meza, Yee Jiun Song |
| 2016 | Peak Efficiency Aware Scheduling for Highly Energy Proportional Servers. | Daniel Wong |
| 2016 | Accelerating Markov Random Field Inference Using Molecular Optical Gibbs Sampling Units. | Siyang Wang, Xiangyu Zhang, Yuxuan Li, Ramin Bashizade, Song Yang, Chris Dwyer, Alvin R. Lebeck |
| 2016 | LaPerm: Locality Aware Scheduler for Dynamic Parallelism on GPUs. | Jin Wang, Norm Rubin, Albert Sidelnik, Sudhakar Yalamanchili |
| 2016 | VisualNoC: A Visualization and Evaluation Environment for Simulation and Mapping. | Junshi Wang, Yang Huang, Masoumeh Ebrahimi, Letian Huang, Qiang Li, Axel Jantsch, Guangjun Li |
| 2016 | Morpheus: Creating Application Objects Efficiently for Heterogeneous Computing. | Hung-Wei Tseng, Qianchen Zhao, Yuxiao Zhou, Mark Gahagan, Steven Swanson |
| 2016 | Can Data-Only Exploits be Detected at Runtime Using Hardware Events?: A Case Study of the Heartbleed Vulnerability. | Gildo Torres, Chen Liu |