Aravind Sukumaran-Rajam
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
29
Venues
15
Active years
2013–2025
Best venue rank
A*
Where they publish
Papers
29 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ISCA | Meta's Second Generation AI Chip: Model-Chip Co-Design and Productionization Experiences. | Joel Coburn, Chunqiang Tang, Sameer Abu Asal, Neeraj Agrawal, Raviteja Chinta, Harish Dattatraya Dixit, Brian Dodds, Saritha Dwarakapuram, Amin Firoozshahian, Cao Gao, Kaustubh Gondkar, Tyler Graf, Junhan Hu, Jian Huang, Sterling Hughes, Adam Hutchin, Bhasker Jakka, Guoqiang Jerry Chen, Indu Kalyanaraman, Ashwin Kamath, Pankaj Kansal, Erum Kazi, Roman Levenstein, Mahesh Maddury, Alex Mastro, Siji Medaiyese, Pritesh Modi, Jack Montgomery, Nadathur Satish, Amit Nagpal, Ashwin Narasimha, Maxim Naumov, Eleanor Ozer, Jongsoo Park, Poorvaja Ramani, Harikrishna Reddy, David Reiss, Deboleena Roy, Sathish Sekar, Arushi Sharma, Pavan Shetty, Aravind Sukumaran-Rajam, Eran Tal, Mike Tsai, Shreya Varshini, Richard Wareing, Olvia Wu, Xiaolong Xie, Jinghan Yang, Hangchen Yu, Tanmay Zargar, Zitong Zeng, Feixiong Zhang, Ajit Mathews, Xun Jiao, Jiyuan Zhang, Emmanuel Menage, Truls Edvard Stokke, Mohammed Sourouri |
| 2023 | PPoPP | TDC: Towards Extremely Efficient CNNs on GPUs via Hardware-Aware Tucker Decomposition. | Lizhi Xiang, Miao Yin, Chengming Zhang, Aravind Sukumaran-Rajam, P. Sadayappan, Bo Yuan, Dingwen Tao |
| 2023 | SC | cuAlign: Scalable Network Alignment on GPU Accelerators. | Lizhi Xiang, Arif M. Khan, S. M. Ferdous, Aravind Sukumaran-Rajam, Mahantesh Halappanavar |
| 2022 | CC | Training of deep learning pipelines on memory-constrained GPUs via segmented fused-tiled execution. | Yufan Xu, Saurabh Raje, Atanas Rountev, Gerald Sabin, Aravind Sukumaran-Rajam, P. Sadayappan |
| 2022 | CGO | Comprehensive Accelerator-Dataflow Co-design Optimization for Convolutional Neural Networks. | Miheer Vaidya, Aravind Sukumaran-Rajam, Atanas Rountev, P. Sadayappan |
| 2021 | ASPLOS | Analytical characterization and design space exploration for optimization of CNNs. | Rui Li, Yufan Xu, Aravind Sukumaran-Rajam, Atanas Rountev, P. Sadayappan |
| 2021 | SC | cuTS: scaling subgraph isomorphism on distributed multi-GPU systems using trie based data structure. | Lizhi Xiang, Arif Khan, Edoardo Serra, Mahantesh Halappanavar, Aravind Sukumaran-Rajam |
| 2021 | SPAA | Efficient Distributed Algorithms for Convolutional Neural Networks. | Rui Li, Yufan Xu, Aravind Sukumaran-Rajam, Atanas Rountev, P. Sadayappan |
| 2020 | KDD | ALO-NMF: Accelerated Locality-Optimized Non-negative Matrix Factorization. | Gordon Euhyun Moon, J. Austin Ellis, Aravind Sukumaran-Rajam, Srinivasan Parthasarathy, P. Sadayappan |
| 2020 | SC | Efficient tiled sparse matrix multiplication through matrix signatures. | Sreyya Emre Kurt, Aravind Sukumaran-Rajam, Fabrice Rastello, P. Sadayappan |
| 2019 | CGO | A Code Generator for High-Performance Tensor Contractions on GPUs. | Jinsung Kim, Aravind Sukumaran-Rajam, Vineeth Thumma, Sriram Krishnamoorthy, Ajay Panyala, Louis-Nol Pouchet, Atanas Rountev, P. Sadayappan |
| 2019 | PPoPP | Adaptive sparse tiling for sparse matrix multiplication. | Changwan Hong, Aravind Sukumaran-Rajam, Israt Nisa, Kunal Singh, P. Sadayappan |
| 2019 | SC | Analytical cache modeling and tilesize optimization for tensor contractions. | Rui Li, Aravind Sukumaran-Rajam, Richard Veras, Tze Meng Low, Fabrice Rastello, Atanas Rountev, P. Sadayappan |
| 2019 | SC | Parallel Data-Local Training for Optimizing Word2Vec Embeddings for Word and Graph Embeddings. | Gordon Euhyun Moon, Denis Newman-Griffis, Jinsung Kim, Aravind Sukumaran-Rajam, Eric Fosler-Lussier, P. Sadayappan |
| 2019 | SC | An efficient mixed-mode representation of sparse tensors. | Israt Nisa, Jiajia Li, Aravind Sukumaran-Rajam, Prashant Singh Rawat, Sriram Krishnamoorthy, P. Sadayappan |
| 2018 | HiPC | Sampled Dense Matrix Multiplication for High-Performance Machine Learning. | Israt Nisa, Aravind Sukumaran-Rajam, Sreyya Emre Kurt, Changwan Hong, P. Sadayappan |
| 2018 | HPDC | Efficient sparse-matrix multi-vector product on GPUs. | Changwan Hong, Aravind Sukumaran-Rajam, Bortik Bandyopadhyay, Jinsung Kim, Sreyya Emre Kurt, Israt Nisa, Shivani Sabhlok, mit V. atalyrek, Srinivasan Parthasarathy, P. Sadayappan |
| 2018 | ICCS | Parallel Latent Dirichlet Allocation on GPUs. | Gordon Euhyun Moon, Israt Nisa, Aravind Sukumaran-Rajam, Bortik Bandyopadhyay, Srinivasan Parthasarathy, P. Sadayappan |
| 2018 | ICS | Optimizing Tensor Contractions in CCSD(T) for Efficient Execution on GPUs. | Jinsung Kim, Aravind Sukumaran-Rajam, Changwan Hong, Ajay Panyala, Rohit Kumar Srivastava, Sriram Krishnamoorthy, P. Sadayappan |
| 2018 | PLDI | GPU code optimization using abstract kernel emulation and sensitivity analysis. | Changwan Hong, Aravind Sukumaran-Rajam, Jinsung Kim, Prashant Singh Rawat, Sriram Krishnamoorthy, Louis-Nol Pouchet, Fabrice Rastello, P. Sadayappan |
| 2018 | PPoPP | Performance modeling for GPUs using abstract kernel emulation. | Changwan Hong, Aravind Sukumaran-Rajam, Jinsung Kim, Prashant Singh Rawat, Sriram Krishnamoorthy, Louis-Nol Pouchet, Fabrice Rastello, P. Sadayappan |
| 2018 | PPoPP | Register optimizations for stencils on GPUs. | Prashant Singh Rawat, Fabrice Rastello, Aravind Sukumaran-Rajam, Louis-Nol Pouchet, Atanas Rountev, P. Sadayappan |
| 2018 | SC | Associative instruction reordering to alleviate register pressure. | Prashant Singh Rawat, Aravind Sukumaran-Rajam, Atanas Rountev, Fabrice Rastello, Louis-Nol Pouchet, P. Sadayappan |
| 2017 | HiPC | Characterization of Data Movement Requirements for Sparse Matrix Computations on GPUs. | Sreyya Emre Kurt, Vineeth Thumma, Changwan Hong, Aravind Sukumaran-Rajam, P. Sadayappan |
| 2017 | HiPC | Parallel LDA with Over-Decomposition. | Gordon Euhyun Moon, Aravind Sukumaran-Rajam, P. Sadayappan |
| 2017 | ICS | On improving performance of sparse matrix-matrix multiplication on GPUs. | Rakshith Kunchum, Ankur Chaudhry, Aravind Sukumaran-Rajam, Qingpeng Niu, Israt Nisa, P. Sadayappan |
| 2017 | PPoPP | Parallel CCD++ on GPU for Matrix Factorization. | Israt Nisa, Aravind Sukumaran-Rajam, Rakshith Kunchum, P. Sadayappan |
| 2014 | RV | Speculative Program Parallelization with Scalable and Decentralized Runtime Verification. | Aravind Sukumaran-Rajam, Juan Manuel Martinez Caamao, Willy Wolff, Alexandra Jimborean, Philippe Clauss |
| 2013 | EuroPar | Online Dynamic Dependence Analysis for Speculative Polyhedral Parallelization. | Alexandra Jimborean, Philippe Clauss, Juan Manuel Martinez Caamao, Aravind Sukumaran-Rajam |