Dhiraj D. Kalamkar
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
14
Venues
5
Active years
2007–2024
Best venue rank
A*
Where they publish
Papers
14 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2024 | HiPC | LOSM: Leveraging OpenMP and Shared Memory for Accelerating Blocking MPI Allreduce. | Pranjal Walia, Ishan Shanware, Karthikeyan Vaidyanathan, Dhiraj D. Kalamkar, Uma M. Natarajan |
| 2021 | SC | Tensor processing primitives: a programming abstraction for efficiency and portability in deep learning workloads. | Evangelos Georganas, Dhiraj D. Kalamkar, Sasikanth Avancha, Menachem Adelman, Cristina Anderson, Alexander Breuer, Jeremy Bruestle, Narendra Chaudhary, Abhisek Kundu, Denise Kutnick, Frank Laub, Md. Vasimuddin, Sanchit Misra, Ramanarayan Mohanty, Hans Pabst, Barukh Ziv, Alexander Heinecke |
| 2021 | SC | DistGNN: scalable distributed training for large-scale graph neural networks. | Md. Vasimuddin, Sanchit Misra, Guixiang Ma, Ramanarayan Mohanty, Evangelos Georganas, Alexander Heinecke, Dhiraj D. Kalamkar, Nesreen K. Ahmed, Sasikanth Avancha |
| 2020 | SC | Optimizing deep learning recommender systems training on CPU cluster architectures. | Dhiraj D. Kalamkar, Evangelos Georganas, Sudarshan Srinivasan, Jianping Chen, Mikhail Shiryaev, Alexander Heinecke |
| 2019 | CLUSTER | Training Google Neural Machine Translation on an Intel CPU Cluster. | Dhiraj D. Kalamkar, Kunal Banerjee, Sudarshan Srinivasan, Srinivas Sridharan, Evangelos Georganas, Mikhail E. Smorkalov, Cong Xu, Alexander Heinecke |
| 2018 | ICLR | Mixed Precision Training of Convolutional Neural Networks using Integer Operations. | Dipankar Das, Naveen Mellempudi, Dheevatsa Mudigere, Dhiraj D. Kalamkar, Sasikanth Avancha, Kunal Banerjee, Srinivas Sridharan, Karthik Vaidyanathan, Bharat Kaul, Evangelos Georganas, Alexander Heinecke, Pradeep Dubey, Jess Corbal, Nikita Shustrov, Roman Dubtsov, Evarist Fomenko, Vadim O. Pirogov |
| 2018 | SC | Anatomy of high-performance deep learning convolutions on SIMD architectures. | Evangelos Georganas, Sasikanth Avancha, Kunal Banerjee, Dhiraj D. Kalamkar, Greg Henry, Hans Pabst, Alexander Heinecke |
| 2015 | SC | Improving concurrency and asynchrony in multithreaded MPI applications using software offloading. | Karthikeyan Vaidyanathan, Dhiraj D. Kalamkar, Kiran Pamnany, Jeff R. Hammond, Pavan Balaji, Dipankar Das, Jongsoo Park, Blint Jo |
| 2014 | SC | Lattice QCD with Domain Decomposition on Intel Xeon Phi Co-Processors. | Simon Heybrock, Blint Jo, Dhiraj D. Kalamkar, Mikhail Smelyanskiy, Karthikeyan Vaidyanathan, Tilo Wettig, Pradeep Dubey |
| 2014 | SC | Efficient Shared-Memory Implementation of High-Performance Conjugate Gradient Benchmark and its Application to Unstructured Matrices. | Jongsoo Park, Mikhail Smelyanskiy, Karthikeyan Vaidyanathan, Alexander Heinecke, Dhiraj D. Kalamkar, Xing Liu, Md. Mostofa Ali Patwary, Yutong Lu, Pradeep Dubey |
| 2014 | SC | Enabling Efficient Multithreaded MPI Communication through a Library-Based Implementation of MPI Endpoints. | Srinivas Sridharan, James Dinan, Dhiraj D. Kalamkar |
| 2012 | SC | Analysis and Optimization of Financial Analytics Benchmark on Modern Multi- and Many-core IA-Based Architectures. | Mikhail Smelyanskiy, Jason Sewall, Dhiraj D. Kalamkar, Nadathur Satish, Pradeep Dubey, Nikita Astafiev, Ilya Burylov, Andrey Nikolaev, Sergey Maidanov, Shuo Li, Sunil Kulkarni, Charles H. Finan, Ekaterina Gonina |
| 2012 | SC | Optimization of geometric multigrid for emerging multi- and manycore processors. | Samuel Williams, Dhiraj D. Kalamkar, Amik Singh, Anand M. Deshpande, Brian van Straalen, Mikhail Smelyanskiy, Ann S. Almgren, Pradeep Dubey, John Shalf, Leonid Oliker |
| 2007 | ISPASS | Simplifying Active Memory Clusters by Leveraging Directory Protocol Threads. | Dhiraj D. Kalamkar, Mainak Chaudhuri, Mark A. Heinrich |