| 2011 | Implications of Merging Phases on Scalability of Multi-core Architectures. | Madhavan Manivannan, Ben H. H. Juurlink, Per Stenstrm |
| 2011 | Parallel Performance Measurement of Heterogeneous Parallel Systems with GPUs. | Allen D. Malony, Scott Biersdorff, Sameer Shende, Heike Jagode, Stanimire Tomov, Guido Juckeland, Robert Dietrich, Duncan Poole, Christopher Lamb |
| 2011 | Bloom Filter Performance on Graphics Engines. | Lin Ma, Roger D. Chamberlain, Jeremy D. Buhler, Mark A. Franklin |
| 2011 | Kernel Assisted Collective Intra-node MPI Communication among Multi-Core and Many-Core CPUs. | Teng Ma, George Bosilca, Aurlien Bouteiller, Brice Goglin, Jeffrey M. Squyres, Jack J. Dongarra |
| 2011 | GSNP: A DNA Single-Nucleotide Polymorphism Detection System with GPU Acceleration. | Mian Lu, Jiuxin Zhao, Qiong Luo, Bingqiang Wang, Shaohua Fu, Zhe Lin |
| 2011 | A DFA with Extended Character-Set for Fast Deep Packet Inspection. | Cong Liu, Ai Chen, Di Wu, Jie Wu |
| 2011 | An Efficient Programming Paradigm for Shared-Memory Master-Worker Video Decoding on TILE64 Many-Core Platform. | Xuan-Yi Lin, Kuan-Chou Lai, Shau-Yin Tseng, Kuan-Ching Li, Yeh-Ching Chung |
| 2011 | GPU Resource Sharing and Virtualization on High Performance Computing Systems. | Teng Li, Vikram K. Narayana, Esam El-Araby, Tarek A. El-Ghazawi |
| 2011 | Understanding the Flooding in Low-Duty-Cycle Wireless Sensor Networks. | Zhenjiang Li, Mo Li, Junliang Liu, Shaojie Tang |
| 2011 | Tolerating Load Miss-Latency by Extending Effective Instruction Window with Low Complexity. | Walter Yuan-Hwa Li, Chin-Ling Huang, Chung-Ping Chung |
| 2011 | ShareStorm: A High-Performance and ISP-Friendly P2P Content Distribution Protocol. | Yingchun Lei, Litang Yang, Yili Gong, Wenjie Wang |
| 2011 | aMOSS: Automated Multi-objective Server Provisioning with Stress-Strain Curving. | Palden Lama, Xiaobo Zhou |
| 2011 | Efficient Bandwidth Allocation with QoS Guarantee for IEEE 802.16 Systems. | Da-Nung Lai, Tsung-Chuan Huang, Hung-Yi Chi |
| 2011 | On the Energy Complexity of Parallel Algorithms. | Vijay Anand Korthikanti, Gul Agha, Mark R. Greenstreet |
| 2011 | A Scalable Tridiagonal Solver for GPUs. | Hee-Seok Kim, Shengzhao Wu, Li-Wen Chang, Wen-mei W. Hwu |
| 2011 | Optimizing Process-to-Core Mappings for Two Dimensional Broadcast/Reduce on Multicore Architectures. | Christer Karlsson, Teresa Davies, Chong Ding, Hui Liu, Zizhong Chen |
| 2011 | Memcached Design on High Performance RDMA Capable Interconnects. | Jithin Jose, Hari Subramoni, Miao Luo, Minjia Zhang, Jian Huang, Md. Wasi-ur-Rahman, Nusrat S. Islam, Xiangyong Ouyang, Hao Wang, Sayantan Sur, Dhabaleswar K. Panda |
| 2011 | UnSync: A Soft Error Resilient Redundant Multicore Architecture. | Reiley Jeyapaul, Fei Hong, Abhishek Rhisheekesan, Aviral Shrivastava, Kyoungwoo Lee |
| 2011 | Adaptive Disk I/O Scheduling for MapReduce in Virtualized Environment. | Shadi Ibrahim, Hai Jin, Lu Lu, Bingsheng He, Song Wu |
| 2011 | Efficient Energy Management Using Adaptive Reinforcement Learning-Based Scheduling in Large-Scale Distributed Systems. | Masnida Hussin, Young Choon Lee, Albert Y. Zomaya |
| 2011 | Video-Like Compression for High Efficiency Database Storage of Wireless Sensor Networks. | Niang-Ying Huang, Chung-Yuan Su, Chi-Cheng Chuang, Ray-I Chang |
| 2011 | LnQ: Building High Performance Dynamic Binary Translators with Existing Compiler Backends. | Chun-Chen Hsu, Pangfeng Liu, Chien-Min Wang, Jan-Jan Wu, Ding-Yong Hong, Pen-Chung Yew, Wei-Chung Hsu |
| 2011 | Memory Mapping and Task Scheduling Techniques for Computation Models of Image Processing on Many-Core Platforms. | Ang-Chih Hsieh, Yi-Ta Wu, Shau-Yin Tseng, TingTing Hwang |
| 2011 | SQLMR : A Scalable Database Management System for Cloud Computing. | Meng-Ju Hsieh, Chao-Rui Chang, Li-Yung Ho, Jan-Jan Wu, Pangfeng Liu |
| 2011 | Energy and Performance Efficient Thread Mapping in NoC-Based CMPs under Process Variations. | Carles Hernndez, Federico Silla, Jos Duato |