Skip to content

Akshay Venkatesh

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

17

Venues

8

Active years

2013–2017

Best venue rank

B

Where they publish

Papers

17 indexed papers, newest first.

YearVenueTitleAuthors
2017ICPPMPI-GDS: High Performance MPI Designs with GPUDirect-aSync for CPU-GPU Control Flow Decoupling.Akshay Venkatesh, Khaled Hamidouche, Sreeram Potluri, Davide Rossetti, Ching-Hsiang Chu, Dhabaleswar K. Panda
2016CCGRIDCUDA Kernel Based Collective Reduction Operations on Large-scale GPU Clusters.Ching-Hsiang Chu, Khaled Hamidouche, Akshay Venkatesh, Ammar Ahmad Awan, Dhabaleswar K. Panda
2016HiPCCUDA M3: Designing Efficient CUDA Managed Memory-Aware MPI by Exploiting GDR and IPC.Khaled Hamidouche, Ammar Ahmad Awan, Akshay Venkatesh, Dhabaleswar K. Panda
2016SCEfficient Reliability Support for Hardware Multicast-Based Broadcast in GPU-enabled Streaming Applications.Ching-Hsiang Chu, Khaled Hamidouche, Hari Subramoni, Akshay Venkatesh, Bracy Elton, Dhabaleswar K. Panda
2016SBAC-PADDesigning High Performance Heterogeneous Broadcast for Streaming Applications on GPU Clusters.Ching-Hsiang Chu, Khaled Hamidouche, Hari Subramoni, Akshay Venkatesh, Bracy Elton, Dhabaleswar K. Panda
2015CCGRIDNon-Blocking PMI Extensions for Fast MPI Startup.Sourav Chakraborty, Hari Subramoni, Adam Moody, Akshay Venkatesh, Jonathan L. Perkins, Dhabaleswar K. Panda
2015CCGRIDPower-Check: An Energy-Efficient Checkpointing Framework for HPC Clusters.Raghunath Raja Chandrasekar, Akshay Venkatesh, Khaled Hamidouche, Dhabaleswar K. Panda
2015CLUSTERExploiting GPUDirect RDMA in Designing High Performance OpenSHMEM for NVIDIA GPU Clusters.Khaled Hamidouche, Akshay Venkatesh, Ammar Ahmad Awan, Hari Subramoni, Ching-Hsiang Chu, Dhabaleswar K. Panda
2015HiPCOffloaded GPU Collectives Using CORE-Direct and CUDA Capabilities on InfiniBand Clusters.Akshay Venkatesh, Khaled Hamidouche, Hari Subramoni, Dhabaleswar K. Panda
2015HOTIImpact of InfiniBand DC Transport Protocol on Energy Consumption of All-to-All Collective Algorithms.Hari Subramoni, Akshay Venkatesh, Khaled Hamidouche, Karen Tomko, Dhabaleswar K. Panda
2015SCA case for application-oblivious energy-efficient MPI runtime.Akshay Venkatesh, Abhinav Vishnu, Khaled Hamidouche, Nathan R. Tallent, Dhabaleswar K. Panda, Darren J. Kerbyson, Adolfy Hoisie
2014HiPCA high performance broadcast design with hardware multicast and GPUDirect RDMA for streaming applications on Infiniband clusters.Akshay Venkatesh, Hari Subramoni, Khaled Hamidouche, Dhabaleswar K. Panda
2014HPDCMIC-Check: a distributed check pointing framework for the intel many integrated cores architecture.Raghunath Rajachandrasekar, Sreeram Potluri, Akshay Venkatesh, Khaled Hamidouche, Md. Wasi-ur-Rahman, Dhabaleswar K. Panda
2013CCGRIDEfficient Intra-node Communication on Intel-MIC Clusters.Sreeram Potluri, Akshay Venkatesh, Devendar Bureddy, Krishna Chaitanya Kandalla, Dhabaleswar K. Panda
2013HOTIDesigning Optimized MPI Broadcast and Allreduce for Many Integrated Core (MIC) InfiniBand Clusters.Krishna Chaitanya Kandalla, Akshay Venkatesh, Khaled Hamidouche, Sreeram Potluri, Devendar Bureddy, Dhabaleswar K. Panda
2013ICPPEfficient Inter-node MPI Communication Using GPUDirect RDMA for InfiniBand Clusters with NVIDIA GPUs.Sreeram Potluri, Khaled Hamidouche, Akshay Venkatesh, Devendar Bureddy, Dhabaleswar K. Panda
2013SCMVAPICH-PRISM: a proxy-based communication framework using InfiniBand and SCIF for intel MIC clusters.Sreeram Potluri, Devendar Bureddy, Khaled Hamidouche, Akshay Venkatesh, Krishna Chaitanya Kandalla, Hari Subramoni, Dhabaleswar K. Panda