Hari Subramoni
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
107
Venues
16
Active years
2008–2026
Best venue rank
A*
Where they publish
Papers
107 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | WACV | From Bands to Depth: Understanding Bathymetry Decisions on Sentinel-2. | Satyaki Roy Chowdhury, Aswathnarayan Radhakrishnan, Hari Subramoni |
| 2025 | CLUSTER | Towards Dynamic Message Passing Protocols for Stencil-Based Communication Patterns. | Kaushik Kandadi Suresh, Bharath Ramesh, Goutham Kalikrishna Reddy Kuncham, Hari Subramoni, Dhabaleswar K. Panda |
| 2025 | ICPP | Design and Optimization of GPU-Aware MPI Allreduce Using Direct Sendrecv Communication. | Chen-Chun Chen, Jinghan Yao, Hari Subramoni, Dhabaleswar K. Panda |
| 2025 | SC | A Streaming Collectives Interface Targeting Dataflow Acceleration and HPC Workloads. | Nicholas Contini, Jake Queiser, Bharath Ramesh, Hari Subramoni, Dhabaleswar K. Panda |
| 2024 | CCGRID | Accelerating Large Language Model Training with Hybrid GPU-based Compression. | Lang Xu, Quentin Anthony, Qinghua Zhou, Nawras Alnaasan, Radha Gulhane, Aamir Shafi, Hari Subramoni, Dhabaleswar K. D. K. Panda |
| 2024 | HiPC | HyperSack: Distributed Hyperparameter Optimization for Deep Learning using Resource-Aware Scheduling on Heterogeneous GPU Systems. | Nawras Alnaasan, Bharath Ramesh, Jinghan Yao, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda |
| 2024 | HiPC | Design and Implementation of Kernel-based MPI Reduction Operations for Intel GPU s. | Chen-Chun Chen, Goutham Kalikrishna Reddy Kuncham, Hari Subramoni, Dhabaleswar K. Panda |
| 2024 | HiPC | Effective and Efficient Offloading Designs for One-Sided Communication to SmartNICs. | Benjamin Michalowicz, Kaushik Kandadi Suresh, Hari Subramoni, Mustafa Abduljabbar, Dhabaleswar K. Panda, Steve Poole |
| 2024 | HiPC | Using BlueField-3 SmartNICs to Offload Vector Operations in Krylov Subspace Methods. | Kaushik Kandadi Suresh, Benjamin Michalowicz, Nick Contini, Bharath Ramesh, Mustafa Abduljabbar, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda |
| 2024 | HiPC | Scaling Large Language Model Training on Frontier with Low-Bandwidth Partitioning. | Lang Xu, Quentin Anthony, Jacob Hatef, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda |
| 2024 | HOTI | Characterizing Communication in Distributed Parameter-Efficient Fine-Tuning for Large Language Models. | Nawras Alnaasan, Horng-Ruey Huang, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda |
| 2024 | HOTI | Demystifying the Communication Characteristics for Distributed Transformer Models. | Quentin Anthony, Benjamin Michalowicz, Jacob Hatef, Lang Xu, Mustafa Abdul Jabbar, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda |
| 2024 | HOTI | OHIO: Improving RDMA Network Scalability in MPI_Alltoall Through Optimized Hierarchical and Intra/Inter-Node Communication Overlap Design. | Tu Tran, Goutham Kalikrishna Reddy Kuncham, Bharath Ramesh, Shulei Xu, Hari Subramoni, Mustafa Abduljabbar, Dhabaleswar K. Panda |
| 2024 | ICPP | The Case for Co-Designing Model Architectures with Hardware. | Quentin Anthony, Jacob Hatef, Deepak Narayanan, Stella Biderman, Stas Bekman, Junqi Yin, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda |
| 2023 | CCGRID | ScaMP: Scalable Meta-Parallelism for Deep Learning Search. | Quentin Anthony, Lang Xu, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda |
| 2023 | CCGRID | ScaMP: Scalable Meta-Parallelism for Deep Learning Search. | Quentin Anthony, Lang Xu, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda |
| 2023 | CCGRID | Implementing and Optimizing a GPU-aware MPI Library for Intel GPUs: Early Experiences. | Chen-Chun Chen, Kawthar Shafie Khorassani, Goutham Kalikrishna Reddy Kuncham, Rahul Vaidya, Mustafa Abduljabbar, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda |
| 2023 | HiPC | Optimized All-to-All Connection Establishment for High-Performance MPI Libraries Over InfiniBand. | Shulei Xu, Goutham Kalikrishna Reddy Kuncham, Mustafa Abduljabbar, Hari Subramoni, Dhabaleswar K. D. K. Panda |
| 2023 | HiPC | Flover: A Temporal Fusion Framework for Efficient Autoregressive Model Parallel Inference. | Jinghan Yao, Nawras Alnaasan, Tian Chen, Aamir Shafi, Hari Subramoni, Dhabaleswar K. D. K. Panda |
| 2023 | HOTI | Battle of the BlueFields: An In-Depth Comparison of the BlueField-2 and BlueField-3 SmartNICs. | Benjamin Michalowicz, Kaushik Kandadi Suresh, Hari Subramoni, Dhabaleswar K. D. K. Panda, Stephen W. Poole |
| 2023 | HOTI | Designing In-network Computing Aware Reduction Collectives in MPI. | Bharath Ramesh, Goutham Kalikrishna Reddy Kuncham, Kaushik Kandadi Suresh, Rahul Vaidya, Nawras Alnaasan, Mustafa Abduljabbar, Aamir Shafi, Hari Subramoni, Dhabaleswar K. D. K. Panda |
| 2023 | ICFEC | Performance Characterization of Using Quantization for DNN Inference on Edge Devices. | Hyunho Ahn, Tian Chen, Nawras Alnaasan, Aamir Shafi, Mustafa Abduljabbar, Hari Subramoni, Dhabaleswar K. Panda |
| 2023 | ICS | Enabling Reconfigurable HPC through MPI-based Inter-FPGA Communication. | Nicholas Contini, Bharath Ramesh, Kaushik Kandadi Suresh, Tu Tran, Benjamin Michalowicz, Mustafa Abduljabbar, Hari Subramoni, Dhabaleswar K. Panda |
| 2023 | SC | MPI-xCCL: A Portable MPI Library over Collective Communication Libraries for Various Accelerators. | Chen-Chun Chen, Kawthar Shafie Khorassani, Pouya Kousha, Qinghua Zhou, Jinghan Yao, Hari Subramoni, Dhabaleswar K. Panda |
| 2023 | SC | Democratizing HPC Access and Use with Knowledge Graphs. | Pouya Kousha, Vivekananda Sathu, Matthew Lieber, Hari Subramoni, Dhabaleswar K. Panda |
| 2022 | CLUSTER | Spark Meets MPI: Towards High-Performance Communication Framework for Spark using MPI. | Kinan Al-Attar, Aamir Shafi, Mustafa Abduljabbar, Hari Subramoni, Dhabaleswar K. Panda |
| 2022 | HiPC | AccDP: Accelerated Data-Parallel Distributed DNN Training for Modern GPU-Based HPC Clusters. | Nawras Alnaasan, Arpan Jain, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda |
| 2022 | HiPC | Designing Efficient Pipelined Communication Schemes using Compression in MPI Libraries. | Bharath Ramesh, Qinghua Zhou, Aamir Shafi, Mustafa Abduljabbar, Hari Subramoni, Dhabaleswar K. Panda |
| 2022 | HiPC | Efficient Personalized and Non-Personalized Alltoall Communication for Modern Multi-HCA GPU-Based Clusters. | Kaushik Kandadi Suresh, Akshay Paniraja Guptha, Benjamin Michalowicz, Bharath Ramesh, Mustafa Abduljabbar, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda |
| 2022 | HiPC | Accelerating Broadcast Communication with GPU Compression for Deep Learning Workloads. | Qinghua Zhou, Quentin Anthony, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda |
| 2022 | HOTI | Network Assisted Non-Contiguous Transfers for GPU-Aware MPI Libraries. | Kaushik Kandadi Suresh, Kawthar Shafie Khorassani, Chen-Chun Chen, Bharath Ramesh, Mustafa Abduljabbar, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda |
| 2021 | CCGRID | Adaptive and Hierarchical Large Message All-to-all Communication Algorithms for Large-scale Dense GPU Systems. | Kawthar Shafie Khorassani, Ching-Hsiang Chu, Quentin G. Anthony, Hari Subramoni, Dhabaleswar K. Panda |
| 2021 | CCGRID | Efficient MPI-based Communication for GPU-Accelerated Dask Applications. | Aamir Shafi, Jahanzeb Maqbool Hashmi, Hari Subramoni, Dhabaleswar K. D. K. Panda |
| 2021 | HiPC | Towards Architecture-aware Hierarchical Communication Trees on Modern HPC Systems. | Bharath Ramesh, Jahanzeb Maqbool Hashmi, Shulei Xu, Aamir Shafi, Seyedeh Mahdieh Ghazimirsaeed, Mohammadreza Bayatpour, Hari Subramoni, Dhabaleswar K. Panda |
| 2021 | HiPC | DistMILE: A Distributed Multi-Level Framework for Scalable Graph Embedding. | Yuntian He, Saket Gurukar, Pouya Kousha, Hari Subramoni, Dhabaleswar K. Panda, Srinivasan Parthasarathy |
| 2021 | HiPC | Large-Message Nonblocking MPI_Iallgather and MPI Ibcast Offload via BlueField-2 DPU. | Nick Sarkauskas, Mohammadreza Bayatpour, Tu Tran, Bharath Ramesh, Hari Subramoni, Dhabaleswar K. Panda |
| 2021 | HiPC | Layout-aware Hardware-assisted Designs for Derived Data Types in MPI. | Kaushik Kandadi Suresh, Bharath Ramesh, Chen-Chun Chen, Seyedeh Mahdieh Ghazimirsaeed, Mohammadreza Bayatpour, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda |
| 2021 | HOTI | Accelerating CPU-based Distributed DNN Training on Modern HPC Clusters using BlueField-2 DPUs. | Arpan Jain, Nawras Alnaasan, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda |
| 2020 | CCGRID | Design and Characterization of InfiniBand Hardware Tag Matching in MPI. | Mohammadreza Bayatpour, Seyedeh Mahdieh Ghazimirsaeed, Shulei Xu, Hari Subramoni, Dhabaleswar K. Panda |
| 2020 | CLUSTER | Dynamic Kernel Fusion for Bulk Non-contiguous Data Transfer on GPU Clusters. | Ching-Hsiang Chu, Kawthar Shafie Khorassani, Qinghua Zhou, Hari Subramoni, Dhabaleswar K. Panda |
| 2020 | HiPC | Blink: Towards Efficient RDMA-based Communication Coroutines for Parallel Python Applications. | Aamir Shafi, Jahanzeb Maqbool Hashmi, Hari Subramoni, Dhabaleswar K. Panda |
| 2020 | ICS | NV-group: link-efficient reduction for distributed deep learning on modern dense GPU systems. | Ching-Hsiang Chu, Pouya Kousha, Ammar Ahmad Awan, Kawthar Shafie Khorassani, Hari Subramoni, Dhabaleswar K. D. K. Panda |
| 2020 | SC | Scalable MPI Collectives using SHARP: Large Scale Performance Evaluation on the TACC Frontera System. | Bharath Ramesh, Kaushik Kandadi Suresh, Nick Sarkauskas, Mohammadreza Bayatpour, Jahanzeb Maqbool Hashmi, Hari Subramoni, Dhabaleswar K. Panda |
| 2020 | SC | Accelerating GPU-based Machine Learning in Python using MPI Library: A Case Study with MVAPICH2-GDR. | Seyedeh Mahdieh Ghazimirsaeed, Quentin Anthony, Aamir Shafi, Hari Subramoni, Dhabaleswar K. D. K. Panda |
| 2020 | SC | GEMS: GPU-enabled memory-aware model-parallelism system for distributed DNN training. | Arpan Jain, Ammar Ahmad Awan, Asmaa M. Aljuhani, Jahanzeb Maqbool Hashmi, Quentin G. Anthony, Hari Subramoni, Dhabaleswar K. Panda, Raghu Machiraju, Anil Parwani |
| 2020 | SC | MPI Meets Cloud: Case Study with Amazon EC2 and Microsoft Azure. | Shulei Xu, Seyedeh Mahdieh Ghazimirsaeed, Jahanzeb Maqbool Hashmi, Hari Subramoni, Dhabaleswar K. Panda |
| 2019 | ASPLOS | Characterizing CUDA Unified Memory (UM)-Aware MPI Designs on Modern GPU Architectures. | Karthik Vadambacheri Manian, A. A. Ammar, Amit Ruhela, Ching-Hsiang Chu, Hari Subramoni, Dhabaleswar K. Panda |
| 2019 | CCGRID | Scalable Distributed DNN Training using TensorFlow and CUDA-Aware MPI: Characterization, Designs, and Performance Evaluation. | Ammar Ahmad Awan, Jeroen Bdorf, Ching-Hsiang Chu, Hari Subramoni, Dhabaleswar K. Panda |
| 2019 | CCGRID | Design and Characterization of Shared Address Space MPI Collectives on Modern Architectures. | Jahanzeb Maqbool Hashmi, Sourav Chakraborty, Mohammadreza Bayatpour, Hari Subramoni, Dhabaleswar K. Panda |
| 2019 | CLUSTER | Performance Characterization of DNN Training using TensorFlow and PyTorch on Modern Clusters. | Arpan Jain, Ammar Ahmad Awan, Quentin Anthony, Hari Subramoni, Dhabaleswar K. Panda |
| 2019 | HiPC | High-Performance Adaptive MPI Derived Datatype Communication for Modern Multi-GPU Systems. | Ching-Hsiang Chu, Jahanzeb Maqbool Hashmi, Kawthar Shafie Khorassani, Hari Subramoni, Dhabaleswar K. Panda |
| 2019 | HiPC | Designing a Profiling and Visualization Tool for Scalable and In-depth Analysis of High-Performance GPU Clusters. | Pouya Kousha, Bharath Ramesh, Kaushik Kandadi Suresh, Ching-Hsiang Chu, Arpan Jain, Nick Sarkauskas, Hari Subramoni, Dhabaleswar K. Panda |
| 2019 | HOTI | Designing Scalable and High-Performance MPI Libraries on Amazon Elastic Fabric Adapter. | Sourav Chakraborty, Shulei Xu, Hari Subramoni, Dhabaleswar K. Panda |
| 2019 | HOTI | Communication Profiling and Characterization of Deep Learning Workloads on Clusters with High-Performance Interconnects. | Ammar Ahmad Awan, Arpan Jain, Ching-Hsiang Chu, Hari Subramoni, Dhabaleswar K. Panda |
| 2019 | PPoPP | High performance distributed deep learning: a beginner's guide. | Dhabaleswar K. Panda, Ammar Ahmad Awan, Hari Subramoni |
| 2019 | SC | Scaling TensorFlow, PyTorch, and MXNet using MVAPICH2 for High-Performance Deep Learning on Frontera. | Arpan Jain, Ammar Ahmad Awan, Hari Subramoni, Dhabaleswar K. Panda |
| 2019 | SC | OMB-UM: Design, Implementation, and Evaluation of CUDA Unified Memory Aware MPI Benchmarks. | Karthik Vadambacheri Manian, Ching-Hsiang Chu, Ammar Ahmad Awan, Kawthar Shafie Khorassani, Hari Subramoni |
| 2019 | SC | Leveraging Network-level parallelism with Multiple Process-Endpoints for MPI Broadcast. | Amit Ruhela, Bharath Ramesh, Sourav Chakraborty, Hari Subramoni, Jahanzeb Maqbool Hashmi, Dhabaleswar K. Panda |
| 2019 | SC | Design and Evaluation of Shared Memory CommunicationBenchmarks on Emerging Architectures using MVAPICH2. | Shulei Xu, Jahanzeb Maqbool Hashmi, Sourav Chakraborty, Hari Subramoni, Dhabaleswar K. Panda |
| 2018 | CLUSTER | SALaR: Scalable and Adaptive Designs for Large Message Reduction Collectives. | Mohammadreza Bayatpour, Jahanzeb Maqbool Hashmi, Sourav Chakraborty, Hari Subramoni, Pouya Kousha, Dhabaleswar K. Panda |
| 2018 | HiPC | OC-DNN: Exploiting Advanced Unified Memory Capabilities in CUDA 9 and Volta GPUs for Out-of-Core DNN Training. | Ammar Ahmad Awan, Ching-Hsiang Chu, Hari Subramoni, Xiaoyi Lu, Dhabaleswar K. Panda |
| 2018 | SC | Cooperative rendezvous protocols for improved performance and overlap. | Sourav Chakraborty, Mohammadreza Bayatpour, Jahanzeb Maqbool Hashmi, Hari Subramoni, Dhabaleswar K. Panda |
| 2017 | CLUSTER | Contention-Aware Kernel-Assisted MPI Collectives for Multi-/Many-Core Systems. | Sourav Chakraborty, Hari Subramoni, Dhabaleswar K. Panda |
| 2017 | CLUSTER | A Scalable Network-Based Performance Analysis Tool for MPI on Large-Scale HPC Systems. | Hari Subramoni, Xiaoyi Lu, Dhabaleswar K. Panda |
| 2017 | HiPC | Kernel-Assisted Communication Engine for MPI on Emerging Manycore Processors. | Jahanzeb Maqbool Hashmi, Khaled Hamidouche, Hari Subramoni, Dhabaleswar K. Panda |
| 2017 | HiPC | Designing Registration Caching Free High-Performance MPI Library with Implicit On-Demand Paging (ODP) of InfiniBand. | Mingzhe Li, Xiaoyi Lu, Hari Subramoni, Dhabaleswar K. Panda |
| 2017 | ICPP | Efficient and Scalable Multi-Source Streaming Broadcast on GPU Clusters for Deep Learning. | Ching-Hsiang Chu, Xiaoyi Lu, Ammar Ahmad Awan, Hari Subramoni, Jahanzeb Maqbool Hashmi, Bracy Elton, Dhabaleswar K. Panda |
| 2017 | SC | An In-depth Performance Characterization of CPU- and GPU-based DNN Training on Modern Architectures. | Ammar Ahmad Awan, Hari Subramoni, Dhabaleswar K. Panda |
| 2017 | SC | Scalable reduction collectives with data partitioning-based multi-leader design. | Mohammadreza Bayatpour, Sourav Chakraborty, Hari Subramoni, Xiaoyi Lu, Dhabaleswar K. Panda |
| 2016 | CCGRID | SHMEMPMI - Shared Memory Based PMI for Improved Performance and Scalability. | Sourav Chakraborty, Hari Subramoni, Jonathan L. Perkins, Dhabaleswar K. Panda |
| 2016 | CloudCom | Impact of HPC Cloud Networking Technologies on Accelerating Hadoop RPC and HBase. | Xiaoyi Lu, Dipti Shankar, Shashank Gugnani, Hari Subramoni, Dhabaleswar K. Panda |
| 2016 | CLUSTER | Adaptive and Dynamic Design for MPI Tag Matching. | Mohammadreza Bayatpour, Hari Subramoni, Sourav Chakraborty, Dhabaleswar K. Panda |
| 2016 | ICPADS | System-Level Scalable Checkpoint-Restart for Petascale Computing. | Jiajun Cao, Kapil Arya, Rohan Garg, L. Shawn Matott, Dhabaleswar K. Panda, Hari Subramoni, Jrme Vienne, Gene Cooperman |
| 2016 | SC | Efficient Reliability Support for Hardware Multicast-Based Broadcast in GPU-enabled Streaming Applications. | Ching-Hsiang Chu, Khaled Hamidouche, Hari Subramoni, Akshay Venkatesh, Bracy Elton, Dhabaleswar K. Panda |
| 2016 | SC | Designing MPI library with on-demand paging (ODP) of infiniband: challenges and benefits. | Mingzhe Li, Khaled Hamidouche, Xiaoyi Lu, Hari Subramoni, Jie Zhang, Dhabaleswar K. Panda |
| 2016 | SBAC-PAD | Designing High Performance Heterogeneous Broadcast for Streaming Applications on GPU Clusters. | Ching-Hsiang Chu, Khaled Hamidouche, Hari Subramoni, Akshay Venkatesh, Bracy Elton, Dhabaleswar K. Panda |
| 2015 | CCGRID | Non-Blocking PMI Extensions for Fast MPI Startup. | Sourav Chakraborty, Hari Subramoni, Adam Moody, Akshay Venkatesh, Jonathan L. Perkins, Dhabaleswar K. Panda |
| 2015 | CLUSTER | Exploiting GPUDirect RDMA in Designing High Performance OpenSHMEM for NVIDIA GPU Clusters. | Khaled Hamidouche, Akshay Venkatesh, Ammar Ahmad Awan, Hari Subramoni, Ching-Hsiang Chu, Dhabaleswar K. Panda |
| 2015 | CLUSTER | High Performance MPI Datatype Support with User-Mode Memory Registration: Challenges, Designs, and Benefits. | Mingzhe Li, Hari Subramoni, Khaled Hamidouche, Xiaoyi Lu, Dhabaleswar K. Panda |
| 2015 | HiPC | Offloaded GPU Collectives Using CORE-Direct and CUDA Capabilities on InfiniBand Clusters. | Akshay Venkatesh, Khaled Hamidouche, Hari Subramoni, Dhabaleswar K. Panda |
| 2015 | HOTI | Impact of InfiniBand DC Transport Protocol on Energy Consumption of All-to-All Collective Algorithms. | Hari Subramoni, Akshay Venkatesh, Khaled Hamidouche, Karen Tomko, Dhabaleswar K. Panda |
| 2014 | HiPC | A high performance broadcast design with hardware multicast and GPUDirect RDMA for streaming applications on Infiniband clusters. | Akshay Venkatesh, Hari Subramoni, Khaled Hamidouche, Dhabaleswar K. Panda |
| 2014 | ICPP | Designing Topology-Aware Communication Schedules for Alltoall Operations in Large InfiniBand Clusters. | Hari Subramoni, Krishna Chaitanya Kandalla, Jithin Jose, Karen Tomko, Karl W. Schulz, Dmitry Pekurovsky, Dhabaleswar K. Panda |
| 2013 | CLUSTER | Design of network topology aware scheduling services for large InfiniBand clusters. | Hari Subramoni, Devendar Bureddy, Krishna Chaitanya Kandalla, Karl W. Schulz, Bill Barth, Jonathan L. Perkins, Mark Daniel Arnold, Dhabaleswar K. Panda |
| 2013 | ICPP | A Novel Functional Partitioning Approach to Design High-Performance MPI-3 Non-blocking Alltoallv Collective on Multi-core Systems. | Krishna Chaitanya Kandalla, Hari Subramoni, Karen Tomko, Dmitry Pekurovsky, Dhabaleswar K. Panda |
| 2013 | ICPP | High-Performance Design of Hadoop RPC with RDMA over InfiniBand. | Xiaoyi Lu, Nusrat S. Islam, Md. Wasi-ur-Rahman, Jithin Jose, Hari Subramoni, Hao Wang, Dhabaleswar K. Panda |
| 2013 | ICS | MIC-RO: enabling efficient remote offload on heterogeneous many integrated core (MIC) clusters with InfiniBand. | Khaled Hamidouche, Sreeram Potluri, Hari Subramoni, Krishna Chaitanya Kandalla, Dhabaleswar K. Panda |
| 2013 | SC | MVAPICH-PRISM: a proxy-based communication framework using InfiniBand and SCIF for intel MIC clusters. | Sreeram Potluri, Devendar Bureddy, Khaled Hamidouche, Akshay Venkatesh, Krishna Chaitanya Kandalla, Hari Subramoni, Dhabaleswar K. Panda |
| 2012 | CCGRID | Scalable Memcached Design for InfiniBand Clusters Using Hybrid Transports. | Jithin Jose, Hari Subramoni, Krishna Chaitanya Kandalla, Md. Wasi-ur-Rahman, Hao Wang, Sundeep Narravula, Dhabaleswar K. Panda |
| 2012 | CLUSTER | Can Network-Offload Based Non-blocking Neighborhood MPI Collectives Improve Communication Overheads of Irregular Graph Algorithms? | Krishna Chaitanya Kandalla, Aydin Bulu, Hari Subramoni, Karen Tomko, Jrme Vienne, Leonid Oliker, Dhabaleswar K. Panda |
| 2012 | CLUSTER | Minimizing Network Contention in InfiniBand Clusters with a QoS-Aware Data-Staging Framework. | Raghunath Rajachandrasekar, Jai Jaswani, Hari Subramoni, Dhabaleswar K. Panda |
| 2012 | EuroPar | A Scalable InfiniBand Network Topology-Aware Performance Analysis Tool for MPI. | Hari Subramoni, Jrme Vienne, Dhabaleswar K. Panda |
| 2012 | HOTI | Performance Analysis and Evaluation of InfiniBand FDR and 40GigE RoCE on HPC and Cloud Computing Systems. | Jrme Vienne, Jitong Chen, Md. Wasi-ur-Rahman, Nusrat S. Islam, Hari Subramoni, Dhabaleswar K. Panda |
| 2012 | ISPASS | Understanding the communication characteristics in HBase: What are the fundamental bottlenecks? | Md. Wasi-ur-Rahman, Jian Huang, Jithin Jose, Xiangyong Ouyang, Hao Wang, Nusrat S. Islam, Hari Subramoni, Chet Murthy, Dhabaleswar K. Panda |
| 2012 | SC | High performance RDMA-based design of HDFS over InfiniBand. | Nusrat S. Islam, Md. Wasi-ur-Rahman, Jithin Jose, Raghunath Rajachandrasekar, Hao Wang, Hari Subramoni, Chet Murthy, Dhabaleswar K. Panda |
| 2012 | SC | Design of a scalable InfiniBand topology service to enable network-topology-aware placement of processes. | Hari Subramoni, Sreeram Potluri, Krishna Chaitanya Kandalla, Bill Barth, Jrme Vienne, Jeff Keasler, Karen A. Tomko, Karl W. Schulz, Adam Moody, Dhabaleswar K. Panda |
| 2011 | CLUSTER | Design and Evaluation of Network Topology-/Speed- Aware Broadcast Algorithms for InfiniBand Clusters. | Hari Subramoni, Krishna Chaitanya Kandalla, Jrme Vienne, Sayantan Sur, Bill Barth, Karen A. Tomko, Robert T. McLay, Karl W. Schulz, Dhabaleswar K. Panda |
| 2011 | EuroPar | INAM - A Scalable InfiniBand Network Analysis and Monitoring Tool. | N. Dandapanthula, Hari Subramoni, Jrme Vienne, Krishna Chaitanya Kandalla, Sayantan Sur, Dhabaleswar K. Panda, Ron Brightwell |
| 2011 | HOTI | Designing Non-blocking Broadcast with Collective Offload on InfiniBand Clusters: A Case Study with HPL. | Krishna Chaitanya Kandalla, Hari Subramoni, Jrme Vienne, S. Pai Raikar, Karen Tomko, Sayantan Sur, Dhabaleswar K. Panda |
| 2011 | ICPP | Memcached Design on High Performance RDMA Capable Interconnects. | Jithin Jose, Hari Subramoni, Miao Luo, Minjia Zhang, Jian Huang, Md. Wasi-ur-Rahman, Nusrat S. Islam, Xiangyong Ouyang, Hao Wang, Sayantan Sur, Dhabaleswar K. Panda |
| 2010 | CCGRID | High Performance Data Transfer in Grid Environment Using GridFTP over InfiniBand. | Hari Subramoni, Ping Lai, Rajkumar Kettimuthu, Dhabaleswar K. Panda |
| 2010 | HOTI | Design and Evaluation of Generalized Collective Communication Primitives with Overlap Using ConnectX-2 Offload Engine. | Hari Subramoni, Krishna Chaitanya Kandalla, Sayantan Sur, Dhabaleswar K. Panda |
| 2010 | ICPP | Improving Application Performance and Predictability Using Multiple Virtual Lanes in Modern Multi-core InfiniBand Clusters. | Hari Subramoni, Ping Lai, Sayantan Sur, Dhabaleswar K. Panda |
| 2009 | CLUSTER | RDMA over Ethernet - A preliminary study. | Hari Subramoni, Ping Lai, Miao Luo, Dhabaleswar K. Panda |
| 2009 | HOTI | Designing Next Generation Clusters: Evaluation of InfiniBand DDR/QDR on Intel Computing Platforms. | Hari Subramoni, Matthew J. Koop, Dhabaleswar K. Panda |
| 2009 | ICPP | Designing Efficient FTP Mechanisms for High Performance Data-Transfer over InfiniBand. | Ping Lai, Hari Subramoni, Sundeep Narravula, Amith R. Mamidala, Dhabaleswar K. Panda |
| 2008 | ICPP | Performance of HPC Middleware over InfiniBand WAN. | Sundeep Narravula, Hari Subramoni, Ping Lai, Ranjit Noronha, Dhabaleswar K. Panda |