Skip to content

Aravind Sukumaran-Rajam

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

29

Venues

15

Active years

2013–2025

Best venue rank

A*

Where they publish

Papers

29 indexed papers, newest first.

YearVenueTitleAuthors
2025ISCAMeta's Second Generation AI Chip: Model-Chip Co-Design and Productionization Experiences.Joel Coburn, Chunqiang Tang, Sameer Abu Asal, Neeraj Agrawal, Raviteja Chinta, Harish Dattatraya Dixit, Brian Dodds, Saritha Dwarakapuram, Amin Firoozshahian, Cao Gao, Kaustubh Gondkar, Tyler Graf, Junhan Hu, Jian Huang, Sterling Hughes, Adam Hutchin, Bhasker Jakka, Guoqiang Jerry Chen, Indu Kalyanaraman, Ashwin Kamath, Pankaj Kansal, Erum Kazi, Roman Levenstein, Mahesh Maddury, Alex Mastro, Siji Medaiyese, Pritesh Modi, Jack Montgomery, Nadathur Satish, Amit Nagpal, Ashwin Narasimha, Maxim Naumov, Eleanor Ozer, Jongsoo Park, Poorvaja Ramani, Harikrishna Reddy, David Reiss, Deboleena Roy, Sathish Sekar, Arushi Sharma, Pavan Shetty, Aravind Sukumaran-Rajam, Eran Tal, Mike Tsai, Shreya Varshini, Richard Wareing, Olvia Wu, Xiaolong Xie, Jinghan Yang, Hangchen Yu, Tanmay Zargar, Zitong Zeng, Feixiong Zhang, Ajit Mathews, Xun Jiao, Jiyuan Zhang, Emmanuel Menage, Truls Edvard Stokke, Mohammed Sourouri
2023PPoPPTDC: Towards Extremely Efficient CNNs on GPUs via Hardware-Aware Tucker Decomposition.Lizhi Xiang, Miao Yin, Chengming Zhang, Aravind Sukumaran-Rajam, P. Sadayappan, Bo Yuan, Dingwen Tao
2023SCcuAlign: Scalable Network Alignment on GPU Accelerators.Lizhi Xiang, Arif M. Khan, S. M. Ferdous, Aravind Sukumaran-Rajam, Mahantesh Halappanavar
2022CCTraining of deep learning pipelines on memory-constrained GPUs via segmented fused-tiled execution.Yufan Xu, Saurabh Raje, Atanas Rountev, Gerald Sabin, Aravind Sukumaran-Rajam, P. Sadayappan
2022CGOComprehensive Accelerator-Dataflow Co-design Optimization for Convolutional Neural Networks.Miheer Vaidya, Aravind Sukumaran-Rajam, Atanas Rountev, P. Sadayappan
2021ASPLOSAnalytical characterization and design space exploration for optimization of CNNs.Rui Li, Yufan Xu, Aravind Sukumaran-Rajam, Atanas Rountev, P. Sadayappan
2021SCcuTS: scaling subgraph isomorphism on distributed multi-GPU systems using trie based data structure.Lizhi Xiang, Arif Khan, Edoardo Serra, Mahantesh Halappanavar, Aravind Sukumaran-Rajam
2021SPAAEfficient Distributed Algorithms for Convolutional Neural Networks.Rui Li, Yufan Xu, Aravind Sukumaran-Rajam, Atanas Rountev, P. Sadayappan
2020KDDALO-NMF: Accelerated Locality-Optimized Non-negative Matrix Factorization.Gordon Euhyun Moon, J. Austin Ellis, Aravind Sukumaran-Rajam, Srinivasan Parthasarathy, P. Sadayappan
2020SCEfficient tiled sparse matrix multiplication through matrix signatures.Sreyya Emre Kurt, Aravind Sukumaran-Rajam, Fabrice Rastello, P. Sadayappan
2019CGOA Code Generator for High-Performance Tensor Contractions on GPUs.Jinsung Kim, Aravind Sukumaran-Rajam, Vineeth Thumma, Sriram Krishnamoorthy, Ajay Panyala, Louis-Nol Pouchet, Atanas Rountev, P. Sadayappan
2019PPoPPAdaptive sparse tiling for sparse matrix multiplication.Changwan Hong, Aravind Sukumaran-Rajam, Israt Nisa, Kunal Singh, P. Sadayappan
2019SCAnalytical cache modeling and tilesize optimization for tensor contractions.Rui Li, Aravind Sukumaran-Rajam, Richard Veras, Tze Meng Low, Fabrice Rastello, Atanas Rountev, P. Sadayappan
2019SCParallel Data-Local Training for Optimizing Word2Vec Embeddings for Word and Graph Embeddings.Gordon Euhyun Moon, Denis Newman-Griffis, Jinsung Kim, Aravind Sukumaran-Rajam, Eric Fosler-Lussier, P. Sadayappan
2019SCAn efficient mixed-mode representation of sparse tensors.Israt Nisa, Jiajia Li, Aravind Sukumaran-Rajam, Prashant Singh Rawat, Sriram Krishnamoorthy, P. Sadayappan
2018HiPCSampled Dense Matrix Multiplication for High-Performance Machine Learning.Israt Nisa, Aravind Sukumaran-Rajam, Sreyya Emre Kurt, Changwan Hong, P. Sadayappan
2018HPDCEfficient sparse-matrix multi-vector product on GPUs.Changwan Hong, Aravind Sukumaran-Rajam, Bortik Bandyopadhyay, Jinsung Kim, Sreyya Emre Kurt, Israt Nisa, Shivani Sabhlok, mit V. atalyrek, Srinivasan Parthasarathy, P. Sadayappan
2018ICCSParallel Latent Dirichlet Allocation on GPUs.Gordon Euhyun Moon, Israt Nisa, Aravind Sukumaran-Rajam, Bortik Bandyopadhyay, Srinivasan Parthasarathy, P. Sadayappan
2018ICSOptimizing Tensor Contractions in CCSD(T) for Efficient Execution on GPUs.Jinsung Kim, Aravind Sukumaran-Rajam, Changwan Hong, Ajay Panyala, Rohit Kumar Srivastava, Sriram Krishnamoorthy, P. Sadayappan
2018PLDIGPU code optimization using abstract kernel emulation and sensitivity analysis.Changwan Hong, Aravind Sukumaran-Rajam, Jinsung Kim, Prashant Singh Rawat, Sriram Krishnamoorthy, Louis-Nol Pouchet, Fabrice Rastello, P. Sadayappan
2018PPoPPPerformance modeling for GPUs using abstract kernel emulation.Changwan Hong, Aravind Sukumaran-Rajam, Jinsung Kim, Prashant Singh Rawat, Sriram Krishnamoorthy, Louis-Nol Pouchet, Fabrice Rastello, P. Sadayappan
2018PPoPPRegister optimizations for stencils on GPUs.Prashant Singh Rawat, Fabrice Rastello, Aravind Sukumaran-Rajam, Louis-Nol Pouchet, Atanas Rountev, P. Sadayappan
2018SCAssociative instruction reordering to alleviate register pressure.Prashant Singh Rawat, Aravind Sukumaran-Rajam, Atanas Rountev, Fabrice Rastello, Louis-Nol Pouchet, P. Sadayappan
2017HiPCCharacterization of Data Movement Requirements for Sparse Matrix Computations on GPUs.Sreyya Emre Kurt, Vineeth Thumma, Changwan Hong, Aravind Sukumaran-Rajam, P. Sadayappan
2017HiPCParallel LDA with Over-Decomposition.Gordon Euhyun Moon, Aravind Sukumaran-Rajam, P. Sadayappan
2017ICSOn improving performance of sparse matrix-matrix multiplication on GPUs.Rakshith Kunchum, Ankur Chaudhry, Aravind Sukumaran-Rajam, Qingpeng Niu, Israt Nisa, P. Sadayappan
2017PPoPPParallel CCD++ on GPU for Matrix Factorization.Israt Nisa, Aravind Sukumaran-Rajam, Rakshith Kunchum, P. Sadayappan
2014RVSpeculative Program Parallelization with Scalable and Decentralized Runtime Verification.Aravind Sukumaran-Rajam, Juan Manuel Martinez Caamao, Willy Wolff, Alexandra Jimborean, Philippe Clauss
2013EuroParOnline Dynamic Dependence Analysis for Speculative Polyhedral Parallelization.Alexandra Jimborean, Philippe Clauss, Juan Manuel Martinez Caamao, Aravind Sukumaran-Rajam