Skip to content

Dhiraj D. Kalamkar

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

14

Venues

5

Active years

2007–2024

Best venue rank

A*

Where they publish

Papers

14 indexed papers, newest first.

YearVenueTitleAuthors
2024HiPCLOSM: Leveraging OpenMP and Shared Memory for Accelerating Blocking MPI Allreduce.Pranjal Walia, Ishan Shanware, Karthikeyan Vaidyanathan, Dhiraj D. Kalamkar, Uma M. Natarajan
2021SCTensor processing primitives: a programming abstraction for efficiency and portability in deep learning workloads.Evangelos Georganas, Dhiraj D. Kalamkar, Sasikanth Avancha, Menachem Adelman, Cristina Anderson, Alexander Breuer, Jeremy Bruestle, Narendra Chaudhary, Abhisek Kundu, Denise Kutnick, Frank Laub, Md. Vasimuddin, Sanchit Misra, Ramanarayan Mohanty, Hans Pabst, Barukh Ziv, Alexander Heinecke
2021SCDistGNN: scalable distributed training for large-scale graph neural networks.Md. Vasimuddin, Sanchit Misra, Guixiang Ma, Ramanarayan Mohanty, Evangelos Georganas, Alexander Heinecke, Dhiraj D. Kalamkar, Nesreen K. Ahmed, Sasikanth Avancha
2020SCOptimizing deep learning recommender systems training on CPU cluster architectures.Dhiraj D. Kalamkar, Evangelos Georganas, Sudarshan Srinivasan, Jianping Chen, Mikhail Shiryaev, Alexander Heinecke
2019CLUSTERTraining Google Neural Machine Translation on an Intel CPU Cluster.Dhiraj D. Kalamkar, Kunal Banerjee, Sudarshan Srinivasan, Srinivas Sridharan, Evangelos Georganas, Mikhail E. Smorkalov, Cong Xu, Alexander Heinecke
2018ICLRMixed Precision Training of Convolutional Neural Networks using Integer Operations.Dipankar Das, Naveen Mellempudi, Dheevatsa Mudigere, Dhiraj D. Kalamkar, Sasikanth Avancha, Kunal Banerjee, Srinivas Sridharan, Karthik Vaidyanathan, Bharat Kaul, Evangelos Georganas, Alexander Heinecke, Pradeep Dubey, Jess Corbal, Nikita Shustrov, Roman Dubtsov, Evarist Fomenko, Vadim O. Pirogov
2018SCAnatomy of high-performance deep learning convolutions on SIMD architectures.Evangelos Georganas, Sasikanth Avancha, Kunal Banerjee, Dhiraj D. Kalamkar, Greg Henry, Hans Pabst, Alexander Heinecke
2015SCImproving concurrency and asynchrony in multithreaded MPI applications using software offloading.Karthikeyan Vaidyanathan, Dhiraj D. Kalamkar, Kiran Pamnany, Jeff R. Hammond, Pavan Balaji, Dipankar Das, Jongsoo Park, Blint Jo
2014SCLattice QCD with Domain Decomposition on Intel Xeon Phi Co-Processors.Simon Heybrock, Blint Jo, Dhiraj D. Kalamkar, Mikhail Smelyanskiy, Karthikeyan Vaidyanathan, Tilo Wettig, Pradeep Dubey
2014SCEfficient Shared-Memory Implementation of High-Performance Conjugate Gradient Benchmark and its Application to Unstructured Matrices.Jongsoo Park, Mikhail Smelyanskiy, Karthikeyan Vaidyanathan, Alexander Heinecke, Dhiraj D. Kalamkar, Xing Liu, Md. Mostofa Ali Patwary, Yutong Lu, Pradeep Dubey
2014SCEnabling Efficient Multithreaded MPI Communication through a Library-Based Implementation of MPI Endpoints.Srinivas Sridharan, James Dinan, Dhiraj D. Kalamkar
2012SCAnalysis and Optimization of Financial Analytics Benchmark on Modern Multi- and Many-core IA-Based Architectures.Mikhail Smelyanskiy, Jason Sewall, Dhiraj D. Kalamkar, Nadathur Satish, Pradeep Dubey, Nikita Astafiev, Ilya Burylov, Andrey Nikolaev, Sergey Maidanov, Shuo Li, Sunil Kulkarni, Charles H. Finan, Ekaterina Gonina
2012SCOptimization of geometric multigrid for emerging multi- and manycore processors.Samuel Williams, Dhiraj D. Kalamkar, Amik Singh, Anand M. Deshpande, Brian van Straalen, Mikhail Smelyanskiy, Ann S. Almgren, Pradeep Dubey, John Shalf, Leonid Oliker
2007ISPASSSimplifying Active Memory Clusters by Leveraging Directory Protocol Threads.Dhiraj D. Kalamkar, Mainak Chaudhuri, Mark A. Heinrich