| 2015 | Hadoop+: Modeling and Evaluating the Heterogeneity for MapReduce Applications in Heterogeneous Clusters. | Wenting He, Huimin Cui, Binbin Lu, Jiacheng Zhao, Shengmei Li, Gong Ruan, Jingling Xue, Xiaobing Feng, Wensen Yang, Youliang Yan |
| 2015 | GreenPar: Scheduling Parallel High Performance Applications in Green Datacenters. | Md. Enamul Haque, Iigo Goiri, Ricardo Bianchini, Thu D. Nguyen |
| 2015 | MODESTO: Data-centric Analytic Optimization of Complex Stencil Programs on Heterogeneous Architectures. | Tobias Gysi, Tobias Grosser, Torsten Hoefler |
| 2015 | Optimistic Delinearization of Parametrically Sized Arrays. | Tobias Grosser, Jagannathan Ramanujam, Louis-Nol Pouchet, P. Sadayappan, Sebastian Pop |
| 2015 | Real-Time In-Memory Checkpointing for Future Hybrid Memory Systems. | Shen Gao, Bingsheng He, Jianliang Xu |
| 2015 | Streaming Task Parallelism. | Albert Cohen |
| 2015 | Criticality-Aware Dynamic Task Scheduling for Heterogeneous Architectures. | Kallia Chronaki, Alejandro Rico, Rosa M. Badia, Eduard Ayguad, Jess Labarta, Mateo Valero |
| 2015 | History-Assisted Adaptive-Granularity Caches (HAAG$) for High Performance 3D DRAM Architectures. | Ke Chen, Sheng Li, Jung Ho Ahn, Naveen Muralimanohar, Jishen Zhao, Cong Xu, Seongil O, Yuan Xie, Jay B. Brockman, Norman P. Jouppi |
| 2015 | Automatic Parallelization of Kernels in Shared-Memory Multi-GPU Nodes. | Javier Cabezas, Llus Vilanova, Isaac Gelado, Thomas B. Jablin, Nacho Navarro, Wen-mei W. Hwu |
| 2015 | Optimizing Overlapped Memory Accesses in User-directed Vectorization. | Diego Caballero, Sara Royuela, Roger Ferrer, Alejandro Duran, Xavier Martorell |
| 2015 | Datacenter Efficiency: What's Next? | Ricardo Bianchini |
| 2015 | Active Access: A Mechanism for High-Performance Distributed Data-Centric Computations. | Maciej Besta, Torsten Hoefler |
| 2015 | Parameterized Diamond Tiling for Stencil Computations with Chapel parallel iterators. | Ian J. Bertolacci, Catherine Olschanowsky, Ben Harshbarger, Bradford L. Chamberlain, David G. Wonnacott, Michelle Mills Strout |
| 2015 | PeerWave: Exploiting Wavefront Parallelism on GPUs with Peer-SM Synchronization. | Mehmet E. Belviranli, Peng Deng, Laxmi N. Bhuyan, Rajiv Gupta, Qi Zhu |
| 2015 | SemCache++: Semantics-Aware Caching for Efficient Multi-GPU Offloading. | Nabeel AlSaber, Milind Kulkarni |
| 2015 | Unique Worker model for OpenMP. | Raghesh Aloor, V. Krishna Nandivada |
| 2015 | zFENCE: Data-less Coherence for Efficient Fences. | Shaizeen Aga, Abhayendra Singh, Satish Narayanasamy |
| 2015 | CSR5: An Efficient Storage Format for Cross-Platform Sparse Matrix-Vector Multiplication. | Weifeng Liu, Brian Vinter |
| 2014 | An end-to-end analysis of file system features on sparse virtual disks. | Ruijin Zhou, Sankaran Sivathanu, Jinpyo Kim, Bing Tsai, Tao Li |
| 2014 | Author retrospective for adaptive reduction parallelization techniques. | Hao Yu, Lawrence Rauchwerger |
| 2014 | An adaptive cross-architecture combination method for graph traversal. | Yang You, Shuaiwen Leon Song, Darren J. Kerbyson |
| 2014 | Author retrospective for increasing the instruction fetch rate via multiple branch prediction and a branch address cache. | Tse-Yu Yeh, Deborah T. Marr, Yale N. Patt |
| 2014 | Author retrospective for PYRROS: static task scheduling and code generation for message passing multiprocessors. | Tao Yang, Apostolos Gerasoulis |
| 2014 | DWC: dynamic write consolidation for phase change memory systems. | Fei Xia, Dejun Jiang, Jin Xiong, Mingyu Chen, Lixin Zhang, Ninghui Sun |
| 2014 | Author retrospective of Dynamic application scheduling using on-line analytics: then and now. | Rich Wolski |