| 2025 | SBAC-PAD | Extraction and Representation of Sparsity Patterns for Efficient Data Transfer on Accelerators. | Yang Su, Toshiyuki Ichiba, Katsuhiro Yoda, Yasuhiro Watanabe, Takahide Yoshikawa, Tarek S. Abdelrahman |
| 2024 | ICPP | RoDMap: A Reserve-on-Demand Mapper for Spatially-Configured Coarse-Grained Reconfigurable Arrays. | Kyle Zhao Bin Chen, Tarek S. Abdelrahman, Reza Azimi, Tomasz S. Czajkowski, Maziar Goudarzi |
| 2024 | ISPA | On-the-Fly Data Layout Conversion for GEMM on AI Accelerators. | Fang Gao, Xingyu Yue, Chenchen Tang, Hongyi Chen, Kai-Ting Amy Wang, Tarek S. Abdelrahman |
| 2022 | ISPA | Reuse-Aware Partitioning of Dataflow Graphs on a Tightly-Coupled CGRA. | Nikhil Sambhus, Tarek S. Abdelrahman |
| 2020 | ICPP | Balancing Graph Processing Workloads Using Work Stealing on Heterogeneous CPU-FPGA Systems. | Matthew Agostini, Francis O'Brien, Tarek S. Abdelrahman |
| 2017 | PPoPP | Launch-Time Optimization of OpenCL GPU Kernels. | Andrew S. D. Lee, Tarek S. Abdelrahman |
| 2015 | ICPP | Automatic Performance Tuning of Stencil Computations on GPUs. | Joseph D. Garvey, Tarek S. Abdelrahman |
| 2015 | ISCA | Clean: a race detector with cleaner semantics. | Cedomir Segulja, Tarek S. Abdelrahman |
| 2014 | FPL | Tile-based bottom-up compilation of custom mesh-of-functional-units FPGA overlays. | Davor Capalija, Tarek S. Abdelrahman |
| 2013 | ASPLOS | Reducing divergence in GPGPU programs with loop merging. | Tianyi David Han, Tarek S. Abdelrahman |
| 2013 | FPL | A high-performance overlay architecture for pipelined execution of data flow graphs. | Davor Capalija, Tarek S. Abdelrahman |
| 2013 | ICPP | Parallel Radix Sort on the AMD Fusion Accelerated Processing Unit. | Michael C. Delorme, Tarek S. Abdelrahman, Chengyan Zhao |
| 2012 | CGO | Efficient bottom-up heap analysis for symbolic path-based data access summaries. | Ivan Matosevic, Tarek S. Abdelrahman |
| 2012 | HPCA | Architectural support for synchronization-free deterministic parallel programming. | Cedomir Segulja, Tarek S. Abdelrahman |
| 2011 | ASPLOS | Reducing branch divergence in GPU programs. | Tianyi David Han, Tarek S. Abdelrahman |
| 2011 | FCCM | Towards Synthesis-Free JIT Compilation to Commodity FPGAs. | Davor Capalija, Tarek S. Abdelrahman |
| 2010 | MICRO | Hardware Support for Relaxed Concurrency Control in Transactional Memory. | Utku Aydonat, Tarek S. Abdelrahman |
| 2009 | ASPLOS | Untitled record | Tianyi David Han, Tarek S. Abdelrahman |
| 2007 | ICPP | Automatic Trace-Based Parallelization of Java Programs. | Borys J. Bradel, Tarek S. Abdelrahman |
| 2005 | SCOPES | Power Optimization for the MLCA Using Dynamic Voltage Scaling. | Ivan Matosevic, Tarek S. Abdelrahman, Faraydon Karim, Alain Mellan |
| 2000 | ICPP | The NUMAchine Multiprocessor. | R. Grindley, Tarek S. Abdelrahman, Stephen Brown, S. Caranci, D. DeVries, Benjamin Gamsa, A. Grbic, M. Gusat, R. Ho, Orran Krieger, Guy G. Lemieux, K. Loveless, Naraig Manjikian, P. McHardy, Sinisa Srbljic, Michael Stumm, Zvonko G. Vranesic, Zeljko Zilic |
| 1997 | ICPP | Automatic Partitioning of Data and Computations on Scalable Shared Memory Multiprocessors. | Sudarsan Tandri, Tarek S. Abdelrahman |
| 1997 | PACT | Tuning Shared Network Cache Size vs. Second-Level Cache Size in Clusters-Based Multiprocessors. | Edward D. Moreno, Sergio Takeo Kofuji, Michael Stumm, Tarek S. Abdelrahman |
| 1996 | ICPP | Scheduling of Wavefront Parallelism on Scalable Shared-memory Multiprocessors. | Naraig Manjikian, Tarek S. Abdelrahman |
| 1996 | PDPTA | Exploiting Task-Level Parallelism Using pTask. | Tarek S. Abdelrahman, Sum Huynh |
| 1996 | PDPTA | Evaluation of Dynamic Data Distributions on NUMA Shared Memory Multiprocessors. | Tarek S. Abdelrahman, Kenneth L. Ma |
| 1995 | ICPP | Fusion of Loops for Parallelism and Locality. | Naraig Manjikian, Tarek S. Abdelrahman |
| 1995 | PDPTA | Latency Hiding on COMA Multiprocessors. | Tarek S. Abdelrahman |
| 1995 | PDPTA | Computation and Data Partitioning on Scalable Shared Memory Multiprocessors. | Sudarsan Tandri, Tarek S. Abdelrahman |