Alexander Heinecke
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
17
Venues
8
Active years
2007–2025
Best venue rank
A*
Where they publish
Papers
17 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ASPLOS | Einsum Trees: An Abstraction for Optimizing the Execution of Tensor Expressions. | Alexander Breuer, Mark Blacher, Max Engel, Joachim Giesen, Alexander Heinecke, Julien Klaus, Stefan Remke |
| 2021 | SC | Tensor processing primitives: a programming abstraction for efficiency and portability in deep learning workloads. | Evangelos Georganas, Dhiraj D. Kalamkar, Sasikanth Avancha, Menachem Adelman, Cristina Anderson, Alexander Breuer, Jeremy Bruestle, Narendra Chaudhary, Abhisek Kundu, Denise Kutnick, Frank Laub, Md. Vasimuddin, Sanchit Misra, Ramanarayan Mohanty, Hans Pabst, Barukh Ziv, Alexander Heinecke |
| 2021 | SC | DistGNN: scalable distributed training for large-scale graph neural networks. | Md. Vasimuddin, Sanchit Misra, Guixiang Ma, Ramanarayan Mohanty, Evangelos Georganas, Alexander Heinecke, Dhiraj D. Kalamkar, Nesreen K. Ahmed, Sasikanth Avancha |
| 2020 | SC | Optimizing deep learning recommender systems training on CPU cluster architectures. | Dhiraj D. Kalamkar, Evangelos Georganas, Sudarshan Srinivasan, Jianping Chen, Mikhail Shiryaev, Alexander Heinecke |
| 2019 | ARITH | Leveraging the bfloat16 Artificial Intelligence Datatype For Higher-Precision Computations. | Greg Henry, Ping Tak Peter Tang, Alexander Heinecke |
| 2019 | CLUSTER | Training Google Neural Machine Translation on an Intel CPU Cluster. | Dhiraj D. Kalamkar, Kunal Banerjee, Sudarshan Srinivasan, Srinivas Sridharan, Evangelos Georganas, Mikhail E. Smorkalov, Cong Xu, Alexander Heinecke |
| 2018 | ICLR | Mixed Precision Training of Convolutional Neural Networks using Integer Operations. | Dipankar Das, Naveen Mellempudi, Dheevatsa Mudigere, Dhiraj D. Kalamkar, Sasikanth Avancha, Kunal Banerjee, Srinivas Sridharan, Karthik Vaidyanathan, Bharat Kaul, Evangelos Georganas, Alexander Heinecke, Pradeep Dubey, Jess Corbal, Nikita Shustrov, Roman Dubtsov, Evarist Fomenko, Vadim O. Pirogov |
| 2018 | SC | Anatomy of high-performance deep learning convolutions on SIMD architectures. | Evangelos Georganas, Sasikanth Avancha, Kunal Banerjee, Dhiraj D. Kalamkar, Greg Henry, Hans Pabst, Alexander Heinecke |
| 2016 | SC | LIBXSMM: accelerating small matrix multiplications by runtime code generation. | Alexander Heinecke, Greg Henry, Maxwell Hutchinson, Hans Pabst |
| 2015 | EuroPar | Optimized Force Calculation in Molecular Dynamics Simulations for the Intel Xeon Phi. | Nikola Tchipev, Amer Wafai, Colin W. Glass, Wolfgang Eckhardt, Alexander Heinecke, Hans-Joachim Bungartz, Philipp Neumann |
| 2015 | SC | Full correlation matrix analysis of fMRI data on Intel Xeon Phi™ coprocessors. | Yida Wang, Michael J. Anderson, Jonathan D. Cohen, Alexander Heinecke, Kai Li, Nadathur Satish, Narayanan Sundaram, Nicholas B. Turk-Browne, Theodore L. Willke |
| 2014 | SC | Petascale High Order Dynamic Rupture Earthquake Simulations on Heterogeneous Supercomputers. | Alexander Heinecke, Alexander Breuer, Sebastian Rettenberger, Michael Bader, Alice-Agnes Gabriel, Christian Pelties, Arndt Bode, William Barth, Xiangke Liao, Karthikeyan Vaidyanathan, Mikhail Smelyanskiy, Pradeep Dubey |
| 2014 | SC | Efficient Shared-Memory Implementation of High-Performance Conjugate Gradient Benchmark and its Application to Unstructured Matrices. | Jongsoo Park, Mikhail Smelyanskiy, Karthikeyan Vaidyanathan, Alexander Heinecke, Dhiraj D. Kalamkar, Xing Liu, Md. Mostofa Ali Patwary, Yutong Lu, Pradeep Dubey |
| 2013 | SC | Many-core architectures boost the pricing of basket options on adaptive sparse grids. | Alexander Heinecke, Jacob Jepsen, Hans-Joachim Bungartz |
| 2012 | ISPDC | Exploiting State-of-the-Art x86 Architectures in Scientific Computing. | Alexander Heinecke, Thomas Auckenthaler, Carsten Trinitis |
| 2011 | EuroPar | Extending a Highly Parallel Data Mining Algorithm to the Intel Many Integrated Core Architecture. | Alexander Heinecke, Michael Klemm, Dirk Pflger, Arndt Bode, Hans-Joachim Bungartz |
| 2007 | PPAM | Hardware-Oriented Implementation of Cache Oblivious Matrix Operations Based on Space-Filling Curves. | Michael Bader, Robert Franz, Stephan Gnther, Alexander Heinecke |