J. Ramanujam
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
65
Venues
20
Active years
1989–2017
Best venue rank
A*
Where they publish
Papers
65 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2017 | HPCC | Improving the Parallel Performance of an NBody Application Using Adaptive Techniques in HPX. | Zahra Khatami, Hartmut Kaiser, J. Ramanujam |
| 2017 | SC | HPX Smart Executors. | Zahra Khatami, Lukas Troska, Hartmut Kaiser, J. Ramanujam, Adrian Serio |
| 2016 | PLDI | Effective padding of multidimensional arrays to avoid cache conflict misses. | Changwan Hong, Wenlei Bao, Albert Cohen, Sriram Krishnamoorthy, Louis-Nol Pouchet, Fabrice Rastello, J. Ramanujam, P. Sadayappan |
| 2016 | SC | A Massively Parallel Distributed N-body Application Implemented with HPX. | Zahra Khatami, Hartmut Kaiser, Patricia Grubel, Adrian Serio, J. Ramanujam |
| 2015 | POPL | On Characterizing the Data Access Complexity of Programs. | Venmugil Elango, Fabrice Rastello, Louis-Nol Pouchet, J. Ramanujam, P. Sadayappan |
| 2015 | PPoPP | Distributed memory code generation for mixed Irregular/Regular computations. | Mahesh Ravishankar, Roshan Dathathri, Venmugil Elango, Louis-Nol Pouchet, J. Ramanujam, Atanas Rountev, P. Sadayappan |
| 2015 | SC | Lost in heterogeneity: architectural selection based on code features. | Sameer AbuAsal, R. Tohid, J. Ramanujam |
| 2015 | SC | SDSLc: a multi-target domain-specific compiler for stencil computations. | Prashant Singh Rawat, Martin Kong, Thomas Henretty, Justin Holewinski, Kevin Stock, Louis-Nol Pouchet, J. Ramanujam, Atanas Rountev, P. Sadayappan |
| 2014 | PLDI | A framework for enhancing data reuse via associative reordering. | Kevin Stock, Martin Kong, Tobias Grosser, Louis-Nol Pouchet, Fabrice Rastello, J. Ramanujam, P. Sadayappan |
| 2014 | SPAA | On characterizing the data movement complexity of computational DAGs for parallel execution. | Venmugil Elango, Fabrice Rastello, Louis-Nol Pouchet, J. Ramanujam, P. Sadayappan |
| 2013 | ASPLOS | Split tiling for GPUs: automatic parallelization using trapezoidal tiles. | Tobias Grosser, Albert Cohen, Paul H. J. Kelly, J. Ramanujam, P. Sadayappan, Sven Verdoolaege |
| 2013 | ICS | A stencil compiler for short-vector SIMD architectures. | Thomas Henretty, Richard Veras, Franz Franchetti, Louis-Nol Pouchet, J. Ramanujam, P. Sadayappan |
| 2012 | CC | Analytical Bounds for Optimal Tile Size Selection. | Jun Shirako, Kamal Sharma, Naznin Fauzia, Louis-Nol Pouchet, J. Ramanujam, P. Sadayappan, Vivek Sarkar |
| 2012 | SC | Code generation for parallel execution of a class of irregular loops on distributed memory systems. | Mahesh Ravishankar, John Eisenlohr, Louis-Nol Pouchet, J. Ramanujam, Atanas Rountev, P. Sadayappan |
| 2011 | CC | Data Layout Transformation for Stencil Computations on Short-Vector SIMD Architectures. | Thomas Henretty, Kevin Stock, Louis-Nol Pouchet, Franz Franchetti, J. Ramanujam, P. Sadayappan |
| 2011 | HiPC | Dynamic selection of tile sizes. | Sanket Tavarageri, Louis-Nol Pouchet, J. Ramanujam, Atanas Rountev, P. Sadayappan |
| 2011 | POPL | Loop transformations: convexity, pruning and optimization. | Louis-Nol Pouchet, Uday Bondhugula, Cdric Bastoul, Albert Cohen, J. Ramanujam, P. Sadayappan, Nicolas Vasilache |
| 2010 | CC | Automatic C-to-CUDA Code Generation for Affine Programs. | Muthu Manikandan Baskaran, J. Ramanujam, P. Sadayappan |
| 2010 | CGO | Parameterized tiling revisited. | Muthu Manikandan Baskaran, Albert Hartono, Sanket Tavarageri, Thomas Henretty, J. Ramanujam, P. Sadayappan |
| 2010 | SC | Combined Iterative and Model-driven Optimization in an Automatic Parallelization Framework. | Louis-Nol Pouchet, Uday Bondhugula, Cdric Bastoul, Albert Cohen, J. Ramanujam, P. Sadayappan |
| 2009 | ICS | Parametric multi-level tiling of imperfectly nested loops. | Albert Hartono, Muthu Manikandan Baskaran, Cdric Bastoul, Albert Cohen, Sriram Krishnamoorthy, Boyana Norris, J. Ramanujam, P. Sadayappan |
| 2009 | PPoPP | Compiler-assisted dynamic scheduling for effective parallelization of loop nests on multicore processors. | Muthu Manikandan Baskaran, Nagavijayalakshmi Vydyanathan, Uday Bondhugula, J. Ramanujam, Atanas Rountev, P. Sadayappan |
| 2008 | CC | Automatic Transformations for Communication-Minimized Parallelization and Locality Optimization in the Polyhedral Model. | Uday Bondhugula, Muthu Manikandan Baskaran, Sriram Krishnamoorthy, J. Ramanujam, Atanas Rountev, P. Sadayappan |
| 2008 | ICS | A compiler framework for optimization of affine loop nests for gpgpus. | Muthu Manikandan Baskaran, Uday Bondhugula, Sriram Krishnamoorthy, J. Ramanujam, Atanas Rountev, P. Sadayappan |
| 2008 | PLDI | A practical automatic polyhedral parallelizer and locality optimizer. | Uday Bondhugula, Albert Hartono, J. Ramanujam, P. Sadayappan |
| 2008 | PPoPP | Automatic data movement and computation mapping for multi-level parallel architectures with explicitly managed memories. | Muthu Manikandan Baskaran, Uday Bondhugula, Sriram Krishnamoorthy, J. Ramanujam, Atanas Rountev, P. Sadayappan |
| 2007 | PLDI | Effective automatic parallelization of stencil computations. | Sriram Krishnamoorthy, Muthu Manikandan Baskaran, Uday Bondhugula, J. Ramanujam, Atanas Rountev, P. Sadayappan |
| 2007 | PPoPP | Automatic mapping of nested loops to FPGAS. | Uday Bondhugula, J. Ramanujam, P. Sadayappan |
| 2007 | RTCSA | Code Size Optimization for Embedded Processors using Commutative Transformations. | Sai Pinnepalli, Jinpyo Hong, J. Ramanujam, Doris L. Carver |
| 2006 | ICCS | Identifying Cost-Effective Common Subexpressions to Reduce Operation Count in Tensor Contraction Evaluations. | Albert Hartono, Qingda Lu, Xiaoyang Gao, Sriram Krishnamoorthy, Marcel Nooijen, Gerald Baumgartner, David E. Bernholdt, Venkatesh Choppella, Russell M. Pitzer, J. Ramanujam, Atanas Rountev, P. Sadayappan |
| 2005 | ICCS | Automated Operation Minimization of Tensor Contraction Expressions in Electronic Structure Calculations. | Albert Hartono, Alexander Sibiryakov, Marcel Nooijen, Gerald Baumgartner, David E. Bernholdt, So Hirata, Chi-Chung Lam, Russell M. Pitzer, J. Ramanujam, P. Sadayappan |
| 2005 | PPoPP | Performance modeling and optimization of parallel out-of-core tensor contractions. | Xiaoyang Gao, Swarup Kumar Sahoo, Chi-Chung Lam, J. Ramanujam, Qingda Lu, Gerald Baumgartner, P. Sadayappan |
| 2003 | CC | Address Register Assignment for Reducing Code Size. | Mahmut T. Kandemir, Mary Jane Irwin, Guilin Chen, J. Ramanujam |
| 2003 | HiPC | Data Locality Optimization for Synthesis of Efficient Out-of-Core Algorithms. | Sandhya Krishnan, Sriram Krishnamoorthy, Gerald Baumgartner, Daniel Cociorva, Chi-Chung Lam, P. Sadayappan, J. Ramanujam, David E. Bernholdt, Venkatesh Choppella |
| 2002 | DAC | Exploiting shared scratch pad memory space in embedded multiprocessor systems. | Mahmut T. Kandemir, J. Ramanujam, Alok N. Choudhary |
| 2002 | PLDI | Space-Time Trade-Off Optimization for a Class of Electronic Structure Calculations. | Daniel Cociorva, Gerald Baumgartner, Chi-Chung Lam, P. Sadayappan, J. Ramanujam, Marcel Nooijen, David E. Bernholdt, Robert J. Harrison |
| 2002 | SC | A high-level approach to synthesis of high-performance codes for quantum chemistry. | Gerald Baumgartner, David E. Bernholdt, Daniel Cociorva, Robert J. Harrison, So Hirata, Chi-Chung Lam, Marcel Nooijen, Russell M. Pitzer, J. Ramanujam, P. Sadayappan |
| 2002 | VLSID | Strategies for Improving Data Locality in Embedded Applications. | N. E. Crosbie, Mahmut T. Kandemir, Ibrahim Kolcu, J. Ramanujam, Alok N. Choudhary |
| 2002 | VLSID | A Heuristic for Clock Selection in High-Level Synthesis. | J. Ramanujam, Sandeep Deshpande, Jinpyo Hong, Mahmut T. Kandemir |
| 2002 | VLSID | Address Code and Arithmetic Optimizations for Embedded Systems. | J. Ramanujam, Satish Krishnamurthy, Jinpyo Hong, Mahmut T. Kandemir |
| 2001 | DAC | Dynamic Management of Scratch-Pad Memory Space. | Mahmut T. Kandemir, J. Ramanujam, Mary Jane Irwin, Narayanan Vijaykrishnan, Ismail Kadayif, Amisha Parikh |
| 2001 | DAC | Reducing Memory Requirements of Nested Loops for Embedded Systems. | J. Ramanujam, Jinpyo Hong, Mahmut T. Kandemir, Amit Narayan |
| 2001 | HiPC | Towards Automatic Synthesis of High-Performance Codes for Electronic Structure Calculations: Data Locality Optimization. | Daniel Cociorva, J. W. Wilkins, Gerald Baumgartner, P. Sadayappan, J. Ramanujam, Marcel Nooijen, David E. Bernholdt, Robert J. Harrison |
| 2001 | ICS | Loop optimization for a class of memory-constrained computations. | Daniel Cociorva, J. W. Wilkins, Chi-Chung Lam, Gerald Baumgartner, J. Ramanujam, P. Sadayappan |
| 2001 | ISLPED | Compiler support for block buffering. | Mahmut T. Kandemir, J. Ramanujam, Ugur Sezer |
| 2000 | DAC | On lower bounds for scheduling problems in high-level synthesis. | M. Narasimhan, J. Ramanujam |
| 2000 | HiPC | Improving Offset Assignment on Embedded Processors Using Transformations. | Sunil Atri, J. Ramanujam, Mahmut T. Kandemir |
| 1999 | EuroPar | I/O-Conscious Tiling for Disk-Resident Data Sets. | Mahmut T. Kandemir, Alok N. Choudhary, J. Ramanujam |
| 1999 | ICPP | Compiler Optimizations for I/O-Intensive Computations. | Mahmut T. Kandemir, Alok N. Choudhary, J. Ramanujam |
| 1999 | ICPP | A Framework for Interprocedural Locality Optimization Using Both Loop and Data Layout Transformations. | Mahmut T. Kandemir, Alok N. Choudhary, J. Ramanujam, Prithviraj Banerjee |
| 1999 | ICS | An integer linear programming approach for optimizing cache locality. | Mahmut T. Kandemir, Prithviraj Banerjee, Alok N. Choudhary, J. Ramanujam, Eduard Ayguad |
| 1998 | EuroPar | Enhancing Spatial Locality via Data Layout Optimizations. | Mahmut T. Kandemir, Alok N. Choudhary, J. Ramanujam, U. Nagaraj Shenoy, Prithviraj Banerjee |
| 1998 | ICCAD | Improving the computational performance of ILP-based problems. | M. Narasimhan, J. Ramanujam |
| 1998 | ICPP | Minimizing Data and Synchronization Costs in One-Way Communication. | Mahmut T. Kandemir, U. Nagaraj Shenoy, Prithviraj Banerjee, J. Ramanujam, Alok N. Choudhary |
| 1998 | ICS | A Hyperplane Based Approach for Optimizing Spatial Locality in Loop Nests. | Mahmut T. Kandemir, Alok N. Choudhary, U. Nagaraj Shenoy, Prithviraj Banerjee, J. Ramanujam |
| 1998 | MICRO | Improving Locality Using Loop and Data Transformations in an Integrated Framework. | Mahmut T. Kandemir, Alok N. Choudhary, J. Ramanujam, Prithviraj Banerjee |
| 1997 | EuroPar | Optimization of Out-of-Core Computations Using Chain Vectors. | Mahmut T. Kandemir, J. Ramanujam, Alok N. Choudhary |
| 1997 | ICPP | Improving the Performance of Out-of-Core Computations. | Mahmut T. Kandemir, J. Ramanujam, Alok N. Choudhary |
| 1997 | ICS | A Compiler Algorithm for Optimizing Locality in Loop Nests. | Mahmut T. Kandemir, J. Ramanujam, Alok N. Choudhary |
| 1996 | EuroPar | A Framework for Integrated Communication and I/O Placement. | Rajesh Bordawekar, Alok N. Choudhary, J. Ramanujam |
| 1996 | ICS | Automatic Optimization of Communication in Compiling Out-of-Core Stencil Codes. | Rajesh Bordawekar, Alok N. Choudhary, J. Ramanujam |
| 1992 | SC | Non-Unimodular Transformations of Nested Loops. | J. Ramanujam |
| 1991 | SC | Tiling multidimensional iteration spaces for nonshared memory machines. | J. Ramanujam, P. Sadayappan |
| 1990 | ICPP | Tiling of Iteration Spaces for Multicomputers. | J. Ramanujam, P. Sadayappan |
| 1989 | SC | A methodology for parallelizing programs for multicomputers and complex memory multiprocessors. | J. Ramanujam, P. Sadayappan |