| 2016 | SWAP-Assembler 2: Optimization of De Novo Genome Assembler at Extreme Scale. | Jintao Meng, Sangmin Seo, Pavan Balaji, Yanjie Wei, Bingqiang Wang, Shengzhong Feng |
| 2016 | Efficient Parallel Algorithms for k-Center Clustering. | Jessica McClintock, Anthony Wirth |
| 2016 | Parallel k-Means++ for Multiple Shared-Memory Architectures. | Patrick Mackey, Robert R. Lewis |
| 2016 | Performance Analysis of GPU-Based Convolutional Neural Networks. | Xiaqing Li, Guangyan Zhang, H. Howie Huang, Zhufan Wang, Weimin Zheng |
| 2016 | RRect: A Novel Server-centric Data Center Network with High Availability. | Zhenhua Li, Yuanyuan Yang |
| 2016 | Tetris Write: Exploring More Write Parallelism Considering PCM Asymmetries. | Zheng Li, Fang Wang, Dan Feng, Yu Hua, Wei Tong, Jingning Liu, Xiang Liu |
| 2016 | Fast RFID Polling Protocols. | Jia Liu, Bin Xiao, Xuan Liu, Lijun Chen |
| 2016 | Making In-Memory Frequent Pattern Mining Durable and Energy Efficient. | Yi Lin, Po-Chun Huang, Duo Liu, Xiao Zhu, Liang Liang |
| 2016 | Improving RAID Performance Using an Endurable SSD Cache. | Chu Li, Dan Feng, Yu Hua, Fang Wang |
| 2016 | A Parallel Hill-Climbing Refinement Algorithm for Graph Partitioning. | Dominique LaSalle, George Karypis |
| 2016 | High Performance Parallel Algorithms for the Tucker Decomposition of Sparse Tensors. | Oguz Kaya, Bora Uar |
| 2016 | Run-Time Performance Estimation and Fairness-Oriented Scheduling Policy for Concurrent GPGPU Applications. | Qingda Hu, Jiwu Shu, Jie Fan, Youyou Lu |
| 2016 | Partial Flattening: A Compilation Technique for Irregular Nested Parallelism on GPGPUs. | Ming-Hsiang Huang, Wuu Yang |
| 2016 | ROP: Alleviating Refresh Overheads via Reviving the Memory System in Frozen Cycles. | Ping Huang, Wenjie Liu, Kun Tang, Xubin He, Ke Zhou |
| 2016 | Exploiting Real-Time Traffic Light Scheduling with Taxi Traces. | Zongjian He, Daqiang Zhang, Jiannong Cao, Xuefeng Liu, Xiaopeng Fan, Cheng-Zhong Xu |
| 2016 | Criticality-Aware Partitioning for Multicore Mixed-Criticality Systems. | Jian-Jun Han, Xin Tao, Dakai Zhu, Hakan Aydin |
| 2016 | AccuracyTrader: Accuracy-Aware Approximate Processing for Low Tail Latency and High Result Accuracy in Cloud Online Services. | Rui Han, Siguang Huang, Fei Tang, Fu-Gui Chang, Jianfeng Zhan |
| 2016 | An Unbounded Nonblocking Double-Ended Queue. | Matthew Graichen, Joseph Izraelevitz, Michael L. Scott |
| 2016 | One-Sided Interface for Matrix Operations Using MPI-3 RMA: A Case Study with Elemental. | Sayan Ghosh, Jeff R. Hammond, Antonio J. Pea, Pavan Balaji, Assefaw Hadish Gebremedhin, Barbara M. Chapman |
| 2016 | The Case for Cross-Component Power Coordination on Power Bounded Systems. | Rong Ge, Xizhou Feng, Yangyang He, Pengfei Zou |
| 2016 | Optimal Multi-taxi Dispatch for Mobile Taxi-Hailing Systems. | Guoju Gao, Mingjun Xiao, Zhenhua Zhao |
| 2016 | Optimal Collision/Conflict-Free Distance-2 Coloring in Wireless Synchronous Broadcast/Receive Tree Networks. | Davide Frey, Hicham Lakhlef, Michel Raynal |
| 2016 | PCAF: Scalable, High Precision k-NN Search Using Principal Component Analysis Based Filtering. | Huan Feng, David M. Eyers, Steven Mills, Yongwei Wu, Zhiyi Huang |
| 2016 | Efficient Virtual Network Embedding for Variable Size Virtual Machines in Fat-Tree Data Centers. | Jun Duan, Yuanyuan Yang |
| 2016 | Think Global, Act Local: A Buffer Cache Design for Global Ordering and Parallel Processing in the WAFL File System. | Peter R. Denz, Matthew Curtis-Maury, Vinay Devadas |