Skip to content

Hari Subramoni

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

107

Venues

16

Active years

2008–2026

Best venue rank

A*

Where they publish

Papers

107 indexed papers, newest first.

YearVenueTitleAuthors
2026WACVFrom Bands to Depth: Understanding Bathymetry Decisions on Sentinel-2.Satyaki Roy Chowdhury, Aswathnarayan Radhakrishnan, Hari Subramoni
2025CLUSTERTowards Dynamic Message Passing Protocols for Stencil-Based Communication Patterns.Kaushik Kandadi Suresh, Bharath Ramesh, Goutham Kalikrishna Reddy Kuncham, Hari Subramoni, Dhabaleswar K. Panda
2025ICPPDesign and Optimization of GPU-Aware MPI Allreduce Using Direct Sendrecv Communication.Chen-Chun Chen, Jinghan Yao, Hari Subramoni, Dhabaleswar K. Panda
2025SCA Streaming Collectives Interface Targeting Dataflow Acceleration and HPC Workloads.Nicholas Contini, Jake Queiser, Bharath Ramesh, Hari Subramoni, Dhabaleswar K. Panda
2024CCGRIDAccelerating Large Language Model Training with Hybrid GPU-based Compression.Lang Xu, Quentin Anthony, Qinghua Zhou, Nawras Alnaasan, Radha Gulhane, Aamir Shafi, Hari Subramoni, Dhabaleswar K. D. K. Panda
2024HiPCHyperSack: Distributed Hyperparameter Optimization for Deep Learning using Resource-Aware Scheduling on Heterogeneous GPU Systems.Nawras Alnaasan, Bharath Ramesh, Jinghan Yao, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda
2024HiPCDesign and Implementation of Kernel-based MPI Reduction Operations for Intel GPU s.Chen-Chun Chen, Goutham Kalikrishna Reddy Kuncham, Hari Subramoni, Dhabaleswar K. Panda
2024HiPCEffective and Efficient Offloading Designs for One-Sided Communication to SmartNICs.Benjamin Michalowicz, Kaushik Kandadi Suresh, Hari Subramoni, Mustafa Abduljabbar, Dhabaleswar K. Panda, Steve Poole
2024HiPCUsing BlueField-3 SmartNICs to Offload Vector Operations in Krylov Subspace Methods.Kaushik Kandadi Suresh, Benjamin Michalowicz, Nick Contini, Bharath Ramesh, Mustafa Abduljabbar, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda
2024HiPCScaling Large Language Model Training on Frontier with Low-Bandwidth Partitioning.Lang Xu, Quentin Anthony, Jacob Hatef, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda
2024HOTICharacterizing Communication in Distributed Parameter-Efficient Fine-Tuning for Large Language Models.Nawras Alnaasan, Horng-Ruey Huang, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda
2024HOTIDemystifying the Communication Characteristics for Distributed Transformer Models.Quentin Anthony, Benjamin Michalowicz, Jacob Hatef, Lang Xu, Mustafa Abdul Jabbar, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda
2024HOTIOHIO: Improving RDMA Network Scalability in MPI_Alltoall Through Optimized Hierarchical and Intra/Inter-Node Communication Overlap Design.Tu Tran, Goutham Kalikrishna Reddy Kuncham, Bharath Ramesh, Shulei Xu, Hari Subramoni, Mustafa Abduljabbar, Dhabaleswar K. Panda
2024ICPPThe Case for Co-Designing Model Architectures with Hardware.Quentin Anthony, Jacob Hatef, Deepak Narayanan, Stella Biderman, Stas Bekman, Junqi Yin, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda
2023CCGRIDScaMP: Scalable Meta-Parallelism for Deep Learning Search.Quentin Anthony, Lang Xu, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda
2023CCGRIDScaMP: Scalable Meta-Parallelism for Deep Learning Search.Quentin Anthony, Lang Xu, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda
2023CCGRIDImplementing and Optimizing a GPU-aware MPI Library for Intel GPUs: Early Experiences.Chen-Chun Chen, Kawthar Shafie Khorassani, Goutham Kalikrishna Reddy Kuncham, Rahul Vaidya, Mustafa Abduljabbar, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda
2023HiPCOptimized All-to-All Connection Establishment for High-Performance MPI Libraries Over InfiniBand.Shulei Xu, Goutham Kalikrishna Reddy Kuncham, Mustafa Abduljabbar, Hari Subramoni, Dhabaleswar K. D. K. Panda
2023HiPCFlover: A Temporal Fusion Framework for Efficient Autoregressive Model Parallel Inference.Jinghan Yao, Nawras Alnaasan, Tian Chen, Aamir Shafi, Hari Subramoni, Dhabaleswar K. D. K. Panda
2023HOTIBattle of the BlueFields: An In-Depth Comparison of the BlueField-2 and BlueField-3 SmartNICs.Benjamin Michalowicz, Kaushik Kandadi Suresh, Hari Subramoni, Dhabaleswar K. D. K. Panda, Stephen W. Poole
2023HOTIDesigning In-network Computing Aware Reduction Collectives in MPI.Bharath Ramesh, Goutham Kalikrishna Reddy Kuncham, Kaushik Kandadi Suresh, Rahul Vaidya, Nawras Alnaasan, Mustafa Abduljabbar, Aamir Shafi, Hari Subramoni, Dhabaleswar K. D. K. Panda
2023ICFECPerformance Characterization of Using Quantization for DNN Inference on Edge Devices.Hyunho Ahn, Tian Chen, Nawras Alnaasan, Aamir Shafi, Mustafa Abduljabbar, Hari Subramoni, Dhabaleswar K. Panda
2023ICSEnabling Reconfigurable HPC through MPI-based Inter-FPGA Communication.Nicholas Contini, Bharath Ramesh, Kaushik Kandadi Suresh, Tu Tran, Benjamin Michalowicz, Mustafa Abduljabbar, Hari Subramoni, Dhabaleswar K. Panda
2023SCMPI-xCCL: A Portable MPI Library over Collective Communication Libraries for Various Accelerators.Chen-Chun Chen, Kawthar Shafie Khorassani, Pouya Kousha, Qinghua Zhou, Jinghan Yao, Hari Subramoni, Dhabaleswar K. Panda
2023SCDemocratizing HPC Access and Use with Knowledge Graphs.Pouya Kousha, Vivekananda Sathu, Matthew Lieber, Hari Subramoni, Dhabaleswar K. Panda
2022CLUSTERSpark Meets MPI: Towards High-Performance Communication Framework for Spark using MPI.Kinan Al-Attar, Aamir Shafi, Mustafa Abduljabbar, Hari Subramoni, Dhabaleswar K. Panda
2022HiPCAccDP: Accelerated Data-Parallel Distributed DNN Training for Modern GPU-Based HPC Clusters.Nawras Alnaasan, Arpan Jain, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda
2022HiPCDesigning Efficient Pipelined Communication Schemes using Compression in MPI Libraries.Bharath Ramesh, Qinghua Zhou, Aamir Shafi, Mustafa Abduljabbar, Hari Subramoni, Dhabaleswar K. Panda
2022HiPCEfficient Personalized and Non-Personalized Alltoall Communication for Modern Multi-HCA GPU-Based Clusters.Kaushik Kandadi Suresh, Akshay Paniraja Guptha, Benjamin Michalowicz, Bharath Ramesh, Mustafa Abduljabbar, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda
2022HiPCAccelerating Broadcast Communication with GPU Compression for Deep Learning Workloads.Qinghua Zhou, Quentin Anthony, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda
2022HOTINetwork Assisted Non-Contiguous Transfers for GPU-Aware MPI Libraries.Kaushik Kandadi Suresh, Kawthar Shafie Khorassani, Chen-Chun Chen, Bharath Ramesh, Mustafa Abduljabbar, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda
2021CCGRIDAdaptive and Hierarchical Large Message All-to-all Communication Algorithms for Large-scale Dense GPU Systems.Kawthar Shafie Khorassani, Ching-Hsiang Chu, Quentin G. Anthony, Hari Subramoni, Dhabaleswar K. Panda
2021CCGRIDEfficient MPI-based Communication for GPU-Accelerated Dask Applications.Aamir Shafi, Jahanzeb Maqbool Hashmi, Hari Subramoni, Dhabaleswar K. D. K. Panda
2021HiPCTowards Architecture-aware Hierarchical Communication Trees on Modern HPC Systems.Bharath Ramesh, Jahanzeb Maqbool Hashmi, Shulei Xu, Aamir Shafi, Seyedeh Mahdieh Ghazimirsaeed, Mohammadreza Bayatpour, Hari Subramoni, Dhabaleswar K. Panda
2021HiPCDistMILE: A Distributed Multi-Level Framework for Scalable Graph Embedding.Yuntian He, Saket Gurukar, Pouya Kousha, Hari Subramoni, Dhabaleswar K. Panda, Srinivasan Parthasarathy
2021HiPCLarge-Message Nonblocking MPI_Iallgather and MPI Ibcast Offload via BlueField-2 DPU.Nick Sarkauskas, Mohammadreza Bayatpour, Tu Tran, Bharath Ramesh, Hari Subramoni, Dhabaleswar K. Panda
2021HiPCLayout-aware Hardware-assisted Designs for Derived Data Types in MPI.Kaushik Kandadi Suresh, Bharath Ramesh, Chen-Chun Chen, Seyedeh Mahdieh Ghazimirsaeed, Mohammadreza Bayatpour, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda
2021HOTIAccelerating CPU-based Distributed DNN Training on Modern HPC Clusters using BlueField-2 DPUs.Arpan Jain, Nawras Alnaasan, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda
2020CCGRIDDesign and Characterization of InfiniBand Hardware Tag Matching in MPI.Mohammadreza Bayatpour, Seyedeh Mahdieh Ghazimirsaeed, Shulei Xu, Hari Subramoni, Dhabaleswar K. Panda
2020CLUSTERDynamic Kernel Fusion for Bulk Non-contiguous Data Transfer on GPU Clusters.Ching-Hsiang Chu, Kawthar Shafie Khorassani, Qinghua Zhou, Hari Subramoni, Dhabaleswar K. Panda
2020HiPCBlink: Towards Efficient RDMA-based Communication Coroutines for Parallel Python Applications.Aamir Shafi, Jahanzeb Maqbool Hashmi, Hari Subramoni, Dhabaleswar K. Panda
2020ICSNV-group: link-efficient reduction for distributed deep learning on modern dense GPU systems.Ching-Hsiang Chu, Pouya Kousha, Ammar Ahmad Awan, Kawthar Shafie Khorassani, Hari Subramoni, Dhabaleswar K. D. K. Panda
2020SCScalable MPI Collectives using SHARP: Large Scale Performance Evaluation on the TACC Frontera System.Bharath Ramesh, Kaushik Kandadi Suresh, Nick Sarkauskas, Mohammadreza Bayatpour, Jahanzeb Maqbool Hashmi, Hari Subramoni, Dhabaleswar K. Panda
2020SCAccelerating GPU-based Machine Learning in Python using MPI Library: A Case Study with MVAPICH2-GDR.Seyedeh Mahdieh Ghazimirsaeed, Quentin Anthony, Aamir Shafi, Hari Subramoni, Dhabaleswar K. D. K. Panda
2020SCGEMS: GPU-enabled memory-aware model-parallelism system for distributed DNN training.Arpan Jain, Ammar Ahmad Awan, Asmaa M. Aljuhani, Jahanzeb Maqbool Hashmi, Quentin G. Anthony, Hari Subramoni, Dhabaleswar K. Panda, Raghu Machiraju, Anil Parwani
2020SCMPI Meets Cloud: Case Study with Amazon EC2 and Microsoft Azure.Shulei Xu, Seyedeh Mahdieh Ghazimirsaeed, Jahanzeb Maqbool Hashmi, Hari Subramoni, Dhabaleswar K. Panda
2019ASPLOSCharacterizing CUDA Unified Memory (UM)-Aware MPI Designs on Modern GPU Architectures.Karthik Vadambacheri Manian, A. A. Ammar, Amit Ruhela, Ching-Hsiang Chu, Hari Subramoni, Dhabaleswar K. Panda
2019CCGRIDScalable Distributed DNN Training using TensorFlow and CUDA-Aware MPI: Characterization, Designs, and Performance Evaluation.Ammar Ahmad Awan, Jeroen Bdorf, Ching-Hsiang Chu, Hari Subramoni, Dhabaleswar K. Panda
2019CCGRIDDesign and Characterization of Shared Address Space MPI Collectives on Modern Architectures.Jahanzeb Maqbool Hashmi, Sourav Chakraborty, Mohammadreza Bayatpour, Hari Subramoni, Dhabaleswar K. Panda
2019CLUSTERPerformance Characterization of DNN Training using TensorFlow and PyTorch on Modern Clusters.Arpan Jain, Ammar Ahmad Awan, Quentin Anthony, Hari Subramoni, Dhabaleswar K. Panda
2019HiPCHigh-Performance Adaptive MPI Derived Datatype Communication for Modern Multi-GPU Systems.Ching-Hsiang Chu, Jahanzeb Maqbool Hashmi, Kawthar Shafie Khorassani, Hari Subramoni, Dhabaleswar K. Panda
2019HiPCDesigning a Profiling and Visualization Tool for Scalable and In-depth Analysis of High-Performance GPU Clusters.Pouya Kousha, Bharath Ramesh, Kaushik Kandadi Suresh, Ching-Hsiang Chu, Arpan Jain, Nick Sarkauskas, Hari Subramoni, Dhabaleswar K. Panda
2019HOTIDesigning Scalable and High-Performance MPI Libraries on Amazon Elastic Fabric Adapter.Sourav Chakraborty, Shulei Xu, Hari Subramoni, Dhabaleswar K. Panda
2019HOTICommunication Profiling and Characterization of Deep Learning Workloads on Clusters with High-Performance Interconnects.Ammar Ahmad Awan, Arpan Jain, Ching-Hsiang Chu, Hari Subramoni, Dhabaleswar K. Panda
2019PPoPPHigh performance distributed deep learning: a beginner's guide.Dhabaleswar K. Panda, Ammar Ahmad Awan, Hari Subramoni
2019SCScaling TensorFlow, PyTorch, and MXNet using MVAPICH2 for High-Performance Deep Learning on Frontera.Arpan Jain, Ammar Ahmad Awan, Hari Subramoni, Dhabaleswar K. Panda
2019SCOMB-UM: Design, Implementation, and Evaluation of CUDA Unified Memory Aware MPI Benchmarks.Karthik Vadambacheri Manian, Ching-Hsiang Chu, Ammar Ahmad Awan, Kawthar Shafie Khorassani, Hari Subramoni
2019SCLeveraging Network-level parallelism with Multiple Process-Endpoints for MPI Broadcast.Amit Ruhela, Bharath Ramesh, Sourav Chakraborty, Hari Subramoni, Jahanzeb Maqbool Hashmi, Dhabaleswar K. Panda
2019SCDesign and Evaluation of Shared Memory CommunicationBenchmarks on Emerging Architectures using MVAPICH2.Shulei Xu, Jahanzeb Maqbool Hashmi, Sourav Chakraborty, Hari Subramoni, Dhabaleswar K. Panda
2018CLUSTERSALaR: Scalable and Adaptive Designs for Large Message Reduction Collectives.Mohammadreza Bayatpour, Jahanzeb Maqbool Hashmi, Sourav Chakraborty, Hari Subramoni, Pouya Kousha, Dhabaleswar K. Panda
2018HiPCOC-DNN: Exploiting Advanced Unified Memory Capabilities in CUDA 9 and Volta GPUs for Out-of-Core DNN Training.Ammar Ahmad Awan, Ching-Hsiang Chu, Hari Subramoni, Xiaoyi Lu, Dhabaleswar K. Panda
2018SCCooperative rendezvous protocols for improved performance and overlap.Sourav Chakraborty, Mohammadreza Bayatpour, Jahanzeb Maqbool Hashmi, Hari Subramoni, Dhabaleswar K. Panda
2017CLUSTERContention-Aware Kernel-Assisted MPI Collectives for Multi-/Many-Core Systems.Sourav Chakraborty, Hari Subramoni, Dhabaleswar K. Panda
2017CLUSTERA Scalable Network-Based Performance Analysis Tool for MPI on Large-Scale HPC Systems.Hari Subramoni, Xiaoyi Lu, Dhabaleswar K. Panda
2017HiPCKernel-Assisted Communication Engine for MPI on Emerging Manycore Processors.Jahanzeb Maqbool Hashmi, Khaled Hamidouche, Hari Subramoni, Dhabaleswar K. Panda
2017HiPCDesigning Registration Caching Free High-Performance MPI Library with Implicit On-Demand Paging (ODP) of InfiniBand.Mingzhe Li, Xiaoyi Lu, Hari Subramoni, Dhabaleswar K. Panda
2017ICPPEfficient and Scalable Multi-Source Streaming Broadcast on GPU Clusters for Deep Learning.Ching-Hsiang Chu, Xiaoyi Lu, Ammar Ahmad Awan, Hari Subramoni, Jahanzeb Maqbool Hashmi, Bracy Elton, Dhabaleswar K. Panda
2017SCAn In-depth Performance Characterization of CPU- and GPU-based DNN Training on Modern Architectures.Ammar Ahmad Awan, Hari Subramoni, Dhabaleswar K. Panda
2017SCScalable reduction collectives with data partitioning-based multi-leader design.Mohammadreza Bayatpour, Sourav Chakraborty, Hari Subramoni, Xiaoyi Lu, Dhabaleswar K. Panda
2016CCGRIDSHMEMPMI - Shared Memory Based PMI for Improved Performance and Scalability.Sourav Chakraborty, Hari Subramoni, Jonathan L. Perkins, Dhabaleswar K. Panda
2016CloudComImpact of HPC Cloud Networking Technologies on Accelerating Hadoop RPC and HBase.Xiaoyi Lu, Dipti Shankar, Shashank Gugnani, Hari Subramoni, Dhabaleswar K. Panda
2016CLUSTERAdaptive and Dynamic Design for MPI Tag Matching.Mohammadreza Bayatpour, Hari Subramoni, Sourav Chakraborty, Dhabaleswar K. Panda
2016ICPADSSystem-Level Scalable Checkpoint-Restart for Petascale Computing.Jiajun Cao, Kapil Arya, Rohan Garg, L. Shawn Matott, Dhabaleswar K. Panda, Hari Subramoni, Jrme Vienne, Gene Cooperman
2016SCEfficient Reliability Support for Hardware Multicast-Based Broadcast in GPU-enabled Streaming Applications.Ching-Hsiang Chu, Khaled Hamidouche, Hari Subramoni, Akshay Venkatesh, Bracy Elton, Dhabaleswar K. Panda
2016SCDesigning MPI library with on-demand paging (ODP) of infiniband: challenges and benefits.Mingzhe Li, Khaled Hamidouche, Xiaoyi Lu, Hari Subramoni, Jie Zhang, Dhabaleswar K. Panda
2016SBAC-PADDesigning High Performance Heterogeneous Broadcast for Streaming Applications on GPU Clusters.Ching-Hsiang Chu, Khaled Hamidouche, Hari Subramoni, Akshay Venkatesh, Bracy Elton, Dhabaleswar K. Panda
2015CCGRIDNon-Blocking PMI Extensions for Fast MPI Startup.Sourav Chakraborty, Hari Subramoni, Adam Moody, Akshay Venkatesh, Jonathan L. Perkins, Dhabaleswar K. Panda
2015CLUSTERExploiting GPUDirect RDMA in Designing High Performance OpenSHMEM for NVIDIA GPU Clusters.Khaled Hamidouche, Akshay Venkatesh, Ammar Ahmad Awan, Hari Subramoni, Ching-Hsiang Chu, Dhabaleswar K. Panda
2015CLUSTERHigh Performance MPI Datatype Support with User-Mode Memory Registration: Challenges, Designs, and Benefits.Mingzhe Li, Hari Subramoni, Khaled Hamidouche, Xiaoyi Lu, Dhabaleswar K. Panda
2015HiPCOffloaded GPU Collectives Using CORE-Direct and CUDA Capabilities on InfiniBand Clusters.Akshay Venkatesh, Khaled Hamidouche, Hari Subramoni, Dhabaleswar K. Panda
2015HOTIImpact of InfiniBand DC Transport Protocol on Energy Consumption of All-to-All Collective Algorithms.Hari Subramoni, Akshay Venkatesh, Khaled Hamidouche, Karen Tomko, Dhabaleswar K. Panda
2014HiPCA high performance broadcast design with hardware multicast and GPUDirect RDMA for streaming applications on Infiniband clusters.Akshay Venkatesh, Hari Subramoni, Khaled Hamidouche, Dhabaleswar K. Panda
2014ICPPDesigning Topology-Aware Communication Schedules for Alltoall Operations in Large InfiniBand Clusters.Hari Subramoni, Krishna Chaitanya Kandalla, Jithin Jose, Karen Tomko, Karl W. Schulz, Dmitry Pekurovsky, Dhabaleswar K. Panda
2013CLUSTERDesign of network topology aware scheduling services for large InfiniBand clusters.Hari Subramoni, Devendar Bureddy, Krishna Chaitanya Kandalla, Karl W. Schulz, Bill Barth, Jonathan L. Perkins, Mark Daniel Arnold, Dhabaleswar K. Panda
2013ICPPA Novel Functional Partitioning Approach to Design High-Performance MPI-3 Non-blocking Alltoallv Collective on Multi-core Systems.Krishna Chaitanya Kandalla, Hari Subramoni, Karen Tomko, Dmitry Pekurovsky, Dhabaleswar K. Panda
2013ICPPHigh-Performance Design of Hadoop RPC with RDMA over InfiniBand.Xiaoyi Lu, Nusrat S. Islam, Md. Wasi-ur-Rahman, Jithin Jose, Hari Subramoni, Hao Wang, Dhabaleswar K. Panda
2013ICSMIC-RO: enabling efficient remote offload on heterogeneous many integrated core (MIC) clusters with InfiniBand.Khaled Hamidouche, Sreeram Potluri, Hari Subramoni, Krishna Chaitanya Kandalla, Dhabaleswar K. Panda
2013SCMVAPICH-PRISM: a proxy-based communication framework using InfiniBand and SCIF for intel MIC clusters.Sreeram Potluri, Devendar Bureddy, Khaled Hamidouche, Akshay Venkatesh, Krishna Chaitanya Kandalla, Hari Subramoni, Dhabaleswar K. Panda
2012CCGRIDScalable Memcached Design for InfiniBand Clusters Using Hybrid Transports.Jithin Jose, Hari Subramoni, Krishna Chaitanya Kandalla, Md. Wasi-ur-Rahman, Hao Wang, Sundeep Narravula, Dhabaleswar K. Panda
2012CLUSTERCan Network-Offload Based Non-blocking Neighborhood MPI Collectives Improve Communication Overheads of Irregular Graph Algorithms?Krishna Chaitanya Kandalla, Aydin Bulu, Hari Subramoni, Karen Tomko, Jrme Vienne, Leonid Oliker, Dhabaleswar K. Panda
2012CLUSTERMinimizing Network Contention in InfiniBand Clusters with a QoS-Aware Data-Staging Framework.Raghunath Rajachandrasekar, Jai Jaswani, Hari Subramoni, Dhabaleswar K. Panda
2012EuroParA Scalable InfiniBand Network Topology-Aware Performance Analysis Tool for MPI.Hari Subramoni, Jrme Vienne, Dhabaleswar K. Panda
2012HOTIPerformance Analysis and Evaluation of InfiniBand FDR and 40GigE RoCE on HPC and Cloud Computing Systems.Jrme Vienne, Jitong Chen, Md. Wasi-ur-Rahman, Nusrat S. Islam, Hari Subramoni, Dhabaleswar K. Panda
2012ISPASSUnderstanding the communication characteristics in HBase: What are the fundamental bottlenecks?Md. Wasi-ur-Rahman, Jian Huang, Jithin Jose, Xiangyong Ouyang, Hao Wang, Nusrat S. Islam, Hari Subramoni, Chet Murthy, Dhabaleswar K. Panda
2012SCHigh performance RDMA-based design of HDFS over InfiniBand.Nusrat S. Islam, Md. Wasi-ur-Rahman, Jithin Jose, Raghunath Rajachandrasekar, Hao Wang, Hari Subramoni, Chet Murthy, Dhabaleswar K. Panda
2012SCDesign of a scalable InfiniBand topology service to enable network-topology-aware placement of processes.Hari Subramoni, Sreeram Potluri, Krishna Chaitanya Kandalla, Bill Barth, Jrme Vienne, Jeff Keasler, Karen A. Tomko, Karl W. Schulz, Adam Moody, Dhabaleswar K. Panda
2011CLUSTERDesign and Evaluation of Network Topology-/Speed- Aware Broadcast Algorithms for InfiniBand Clusters.Hari Subramoni, Krishna Chaitanya Kandalla, Jrme Vienne, Sayantan Sur, Bill Barth, Karen A. Tomko, Robert T. McLay, Karl W. Schulz, Dhabaleswar K. Panda
2011EuroParINAM - A Scalable InfiniBand Network Analysis and Monitoring Tool.N. Dandapanthula, Hari Subramoni, Jrme Vienne, Krishna Chaitanya Kandalla, Sayantan Sur, Dhabaleswar K. Panda, Ron Brightwell
2011HOTIDesigning Non-blocking Broadcast with Collective Offload on InfiniBand Clusters: A Case Study with HPL.Krishna Chaitanya Kandalla, Hari Subramoni, Jrme Vienne, S. Pai Raikar, Karen Tomko, Sayantan Sur, Dhabaleswar K. Panda
2011ICPPMemcached Design on High Performance RDMA Capable Interconnects.Jithin Jose, Hari Subramoni, Miao Luo, Minjia Zhang, Jian Huang, Md. Wasi-ur-Rahman, Nusrat S. Islam, Xiangyong Ouyang, Hao Wang, Sayantan Sur, Dhabaleswar K. Panda
2010CCGRIDHigh Performance Data Transfer in Grid Environment Using GridFTP over InfiniBand.Hari Subramoni, Ping Lai, Rajkumar Kettimuthu, Dhabaleswar K. Panda
2010HOTIDesign and Evaluation of Generalized Collective Communication Primitives with Overlap Using ConnectX-2 Offload Engine.Hari Subramoni, Krishna Chaitanya Kandalla, Sayantan Sur, Dhabaleswar K. Panda
2010ICPPImproving Application Performance and Predictability Using Multiple Virtual Lanes in Modern Multi-core InfiniBand Clusters.Hari Subramoni, Ping Lai, Sayantan Sur, Dhabaleswar K. Panda
2009CLUSTERRDMA over Ethernet - A preliminary study.Hari Subramoni, Ping Lai, Miao Luo, Dhabaleswar K. Panda
2009HOTIDesigning Next Generation Clusters: Evaluation of InfiniBand DDR/QDR on Intel Computing Platforms.Hari Subramoni, Matthew J. Koop, Dhabaleswar K. Panda
2009ICPPDesigning Efficient FTP Mechanisms for High Performance Data-Transfer over InfiniBand.Ping Lai, Hari Subramoni, Sundeep Narravula, Amith R. Mamidala, Dhabaleswar K. Panda
2008ICPPPerformance of HPC Middleware over InfiniBand WAN.Sundeep Narravula, Hari Subramoni, Ping Lai, Ranjit Noronha, Dhabaleswar K. Panda