| 2009 | Mapping the FDTD Application to Many-Core Chip Architectures. | Daniel A. Orozco, Guang R. Gao |
| 2009 | Green Multicore-SoC Software-Execution Framework with Timely-Power-Gating Scheme. | Masafumi Onouchi, Keisuke Toyama, Tohru Nojiri, Makoto Sato, Masayoshi Mase, Jun Shirako, Mikiko Sato, Masashi Takada, Masayuki Ito, Hiroyuki Mizuno, Mitaro Namiki, Keiji Kimura, Hironori Kasahara |
| 2009 | A Resource Optimized Remote-Memory-Access Architecture for Low-latency Communication. | Mondrian Nssle, Martin Scherer, Ulrich Brning |
| 2009 | Employing Transactional Memory and Helper Threads to Speedup Dijkstra's Algorithm. | Konstantinos Nikas, Nikos Anastopoulos, Georgios I. Goumas, Nectarios Koziris |
| 2009 | Using Coherence Information and Decay Techniques to Optimize L2 Cache Leakage in CMPs. | Matteo Monchiero, Ramon Canal, Antonio Gonzlez |
| 2009 | On the Scalability of Parallel Verilog Simulation. | Sina Meraji, Wei Zhang, Carl Tropper |
| 2009 | Hardware Implementation Study of the Deficit Table Egress Link Scheduling Algorithm. | Ral Martnez, Jos M. Claver, Francisco Jos Alfaro, Jos L. Snchez |
| 2009 | A Distributed Three-hop Routing Protocol to Increase the Capacity of Hybrid Networks. | Ze Li, Haiying Shen |
| 2009 | Designing Efficient FTP Mechanisms for High Performance Data-Transfer over InfiniBand. | Ping Lai, Hari Subramoni, Sundeep Narravula, Amith R. Mamidala, Dhabaleswar K. Panda |
| 2009 | Analysis of Parallel Algorithms for Energy Conservation in Scalable Multicore Architectures. | Vijay Anand Korthikanti, Gul Agha |
| 2009 | Scalability of Time- and Space-Efficient Embedded Runge-Kutta Solvers for Distributed Address Space. | Matthias Korch, Thomas Rauber |
| 2009 | A Parallel Branch and Bound Algorithm for Workflow QoS Optimization. | Kevin Kofler, Irfan Ul Haq, Erich Schikuta |
| 2009 | Efficient Scheduling of Nested Parallel Loops on Multi-Core Systems. | Arun Kejariwal, Alexandru Nicolau, Alexander V. Veidenbaum, Utpal Banerjee, Constantine D. Polychronopoulos |
| 2009 | Bank-aware Dynamic Cache Partitioning for Multicore Architectures. | Dimitris Kaseridis, Jeffrey Stuecheli, Lizy K. John |
| 2009 | A Parallel Skeleton Library for Multi-core Clusters. | Yuki Karasawa, Hideya Iwasaki |
| 2009 | Perfomance Models for Blocked Sparse Matrix-Vector Multiplication Kernels. | Vasileios Karakasis, Georgios I. Goumas, Nectarios Koziris |
| 2009 | Fast Isosurface Extraction for Medical Volume Dataset on Cell BE. | Hai Jin, Bo Li, Ran Zheng, Qin Zhang |
| 2009 | Generalizing k-Betweenness Centrality Using Short Paths and a Parallel Multithreaded Implementation. | Karl Jiang, David Ediger, David A. Bader |
| 2009 | Complexity Analysis and Performance Evaluation of Matrix Product on Multicore Architectures. | Mathias Jacquelin, Loris Marchal, Yves Robert |
| 2009 | Group Operation Assembly Language - A Flexible Way to Express Collective Communication. | Torsten Hoefler, Christian Siebert, Andrew Lumsdaine |
| 2009 | A Partition-Merge Based Cache-Conscious Parallel Sorting Algorithm for CMP with Shared Cache. | Song Hao, Zhihui Du, David A. Bader, Yin Ye |
| 2009 | Thread Merging Schemes for Multithreaded Clustered VLIW Processors. | Manoj Gupta, Fermn Snchez, Josep Llosa |
| 2009 | CIFTS: A Coordinated Infrastructure for Fault-Tolerant Systems. | Rinku Gupta, Peter H. Beckman, Byung-Hoon Park, Ewing L. Lusk, Paul Hargrove, Al Geist, Dhabaleswar K. Panda, Andrew Lumsdaine, Jack J. Dongarra |
| 2009 | LeWI: A Runtime Balancing Algorithm for Nested Parallelism. | Marta Garcia, Julita Corbaln, Jess Labarta |
| 2009 | Using Subfiling to Improve Programming Flexibility and Performance of Parallel Shared-file I/O. | Kui Gao, Wei-keng Liao, Arifa Nisar, Alok N. Choudhary, Robert B. Ross, Robert Latham |