Pavan Balaji
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
123
Venues
23
Active years
2002–2026
Best venue rank
A*
Where they publish
- BCCGRID20 papers
- ASC17 papers
- CCLUSTER17 papers
- BICPADS12 papers
- BICPP10 papers
- CHPCC8 papers
- NationalHiPC7 papers
- NationalHOTI5 papers
- BPPoPP4 papers
- AICS4 papers
- AHPDC4 papers
- BISPASS3 papers
- BEuroPar2 papers
- A*SIGCOMM1 paper
- A*ICML1 paper
- A*ISCA1 paper
- A*DAC1 paper
- CISPDC1 paper
- MulticonferenceICCS1 paper
- CDASC1 paper
- AICDCS1 paper
- BICCCN1 paper
- CJSSPP1 paper
Papers
123 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | SIGCOMM | Connecting 100K+ GPUs: Building the Communication Stack for Large-Scale LLM Training. | Hongyi Zeng, Min Si, Pavan Balaji, Yongzhou Chen, Ching-Hsiang Chu, Adithya Gangidi, Prashanth Kannan, Bingzhe Liu, Saif Hasan, Dong He, Deep Shah, Ashmitha Jeevaraj Shetty, Gregory R. Steinbrecher, Srikanth Sundaresan, Yulun Wang, Yexin Wu, Mingran Yang, Kenny Yu, Minlan Yu, Cen Zhao, Shengbao Zheng, Wesley Bland, Denis Boyda, Suman Gumudavelli, Subodh Iyengar, Daniel Johnson, Cristian Lumezanu, Kai Luo, Rui Miao, Zhe Qu, Venkatraghavan Ramesh, Jingliang Ren, Maxim Samoylov, Jan Seidel, Qiye Tan, Feng Tian, Xinfeng Xie, Jingyi Yang, Yimeng Zhao, Shuqiang Zhang, Tiane Art Zhu |
| 2025 | ICML | HALoS: Hierarchical Asynchronous Local SGD over Slow Networks for Geo-Distributed Large Language Model Training. | Geon-Woo Kim, Junbo Li, Shashidhar Gandham, Omar Baldonado, Adithya Gangidi, Pavan Balaji, Zhangyang Wang, Aditya Akella |
| 2025 | ISCA | Scaling Llama 3 Training with Efficient Parallelism Strategies. | Weiwei Chu, Xinfeng Xie, Jiecao Yu, Jie Wang, Amar Phanishayee, Chunqiang Tang, Yuchen Hao, Jianyu Huang, Mustafa Ozdal, Jun Wang, Vedanuj Goswami, Naman Goyal, Abhishek Kadian, Andrew Gu, Chris Cai, Feng Tian, Xiaodong Wang, Min Si, Pavan Balaji, Ching-Hsiang Chu, Jongsoo Park |
| 2024 | DAC | UpDLRM: Accelerating Personalized Recommendation using Real-World PIM Architecture. | Sitian Chen, Haobin Tan, Amelie Chi Zhou, Yusen Li, Pavan Balaji |
| 2024 | SC | Accelerating Communication in Deep Learning Recommendation Model Training with Dual-Level Adaptive Lossy Compression. | Hao Feng, Boyuan Zhang, Fanjiang Ye, Min Si, Ching-Hsiang Chu, Jiannan Tian, Chunxing Yin, Summer Deng, Yuchen Hao, Pavan Balaji, Tong Geng, Dingwen Tao |
| 2021 | CCGRID | RMACXX: An Efficient High-Level C++ Interface over MPI-3 RMA. | Sayan Ghosh, Yanfei Guo, Pavan Balaji, Assefaw H. Gebremedhin |
| 2021 | CLUSTER | Daps: A Dynamic Asynchronous Progress Stealing Model for MPI Communication. | Kaiming Ouyang, Min Si, Atsushi Hori, Zizhong Chen, Pavan Balaji |
| 2021 | PPoPP | Lightweight preemptive user-level threads. | Shumpei Shiina, Shintaro Iwasaki, Kenjiro Taura, Pavan Balaji |
| 2021 | SC | Pilgrim: scalable and (near) lossless MPI tracing. | Chen Wang, Pavan Balaji, Marc Snir |
| 2020 | HPCC | Probing the Underlying Implementation Mechanisms of SW26010. | Xiaomin Zhu, Yaqian Zhao, Pavan Balaji |
| 2020 | ICS | How I learned to stop worrying about user-visible endpoints and love MPI. | Rohit Zambre, Aparna Chandramowlishwaran, Pavan Balaji |
| 2020 | SC | Implementing Flexible Threading Support in Open MPI. | Noah Evans, Jan Ciesko, Stephen L. Olivier, Howard Pritchard, Shintaro Iwasaki, Ken Raffenetti, Pavan Balaji |
| 2020 | SC | CAB-MPI: exploring interprocess work-stealing towards balanced MPI communication. | Kaiming Ouyang, Min Si, Atsushi Hori, Zizhong Chen, Pavan Balaji |
| 2019 | HPCC | An Auto Code Generator for Stencil on SW26010. | Xiaomin Zhu, Yunhui Zeng, Yanjie Wei, Shengzhong Feng, Weiguo Liu, Pavan Balaji |
| 2019 | ICPP | Optimized Execution of Parallel Loops via User-Defined Scheduling Policies. | Seonmyeong Bak, Yanfei Guo, Pavan Balaji, Vivek Sarkar |
| 2019 | ICS | Software combining to mitigate multithreaded MPI contention. | Abdelhalim Amer, Charles Archer, Michael Blocksome, Chongxiao Cao, Michael Chuvelev, Hajime Fujita, Maria Garzaran, Yanfei Guo, Jeff R. Hammond, Shintaro Iwasaki, Kenneth J. Raffenetti, Mikhail Shiryaev, Min Si, Kenjiro Taura, Sagar Thapaliya, Pavan Balaji |
| 2018 | HPDC | Process-in-process: techniques for practical address-space sharing. | Atsushi Hori, Min Si, Balazs Gerofi, Masamichi Takagi, Jai Dayal, Pavan Balaji, Yutaka Ishikawa |
| 2018 | ICPADS | On the Power of Combiner Optimizations in MapReduce Over MPI Workflows. | Tao Gao, Yanfei Guo, Boyu Zhang, Pietro Cicotti, Yutong Lu, Pavan Balaji, Michela Taufer |
| 2018 | ICPADS | Scalable Communication Endpoints for MPI+Threads Applications. | Rohit Zambre, Aparna Chandramowlishwaran, Pavan Balaji |
| 2018 | SC | Characterization of MPI usage on a production supercomputer. | Sudheer Chunduri, Scott Parker, Pavan Balaji, Kevin Harms, Kalyan Kumaran |
| 2018 | SC | Lessons learned from analyzing dynamic promotion for user-level threading. | Shintaro Iwasaki, Abdelhalim Amer, Kenjiro Taura, Pavan Balaji |
| 2017 | CCGRID | Advanced Thread Synchronization for Multithreaded MPI Implementations. | Hoang-Vu Dang, Sangmin Seo, Abdelhalim Amer, Pavan Balaji |
| 2017 | CCGRID | Scalable Assembly for Massive Genomic Graphs. | Jintao Meng, Ning Guo, Jianqiu Ge, Yanjie Wei, Pavan Balaji, Bingqiang Wang |
| 2017 | CCGRID | A Performance Study of UCX over InfiniBand. | Nikela Papadopoulou, Lena Oden, Pavan Balaji |
| 2017 | CLUSTER | S-Aligner: Ultrascalable Read Mapping on Sunway Taihu Light. | Xiaohui Duan, Kai Xu, Yuandong Chan, Christian Hundt, Bertil Schmidt, Pavan Balaji, Weiguo Liu |
| 2017 | EuroPar | GLT: A Unified API for Lightweight Thread Libraries. | Adrin Castell, Sangmin Seo, Rafael Mayo, Pavan Balaji, Enrique S. Quintana-Ort, Antonio J. Pea |
| 2017 | HiPC | Exploiting Common Neighborhoods to Optimize MPI Neighborhood Collectives. | Seyed Hessam Mirsadeghi, Jesper Larsson Trff, Pavan Balaji, Ahmad Afsahi |
| 2017 | HPCC | Towards Scalable Deep Learning via I/O Analysis and Optimization. | Sarunya Pumma, Min Si, Wu-chun Feng, Pavan Balaji |
| 2017 | HPCC | Process-Based Asynchronous Progress Model for MPI Point-to-Point Communication. | Min Si, Pavan Balaji |
| 2017 | ICPADS | Bloomfish: A Highly Scalable Distributed K-mer Counting Framework. | Tao Gao, Yanfei Guo, Yanjie Wei, Bingqiang Wang, Yutong Lu, Pietro Cicotti, Pavan Balaji, Michela Taufer |
| 2017 | ICPADS | Portable Topology-Aware MPI-I/O. | Robert Latham, Leonardo Bautista-Gomez, Pavan Balaji |
| 2017 | ICPADS | Hexe: A Toolkit for Heterogeneous Memory Management. | Lena Oden, Pavan Balaji |
| 2017 | ICPADS | Parallel I/O Optimizations for Scalable Deep Learning. | Sarunya Pumma, Min Si, Wu-chun Feng, Pavan Balaji |
| 2017 | ICPP | GLTO: On the Adequacy of Lightweight Thread Approaches for OpenMP Implementations. | Adrin Castell, Sangmin Seo, Rafael Mayo, Pavan Balaji, Enrique S. Quintana-Ort, Antonio J. Pea |
| 2017 | SC | Why is MPI so slow?: analyzing the fundamental limits in implementing MPI-3.1. | Ken Raffenetti, Abdelhalim Amer, Lena Oden, Charles Archer, Wesley Bland, Hajime Fujita, Yanfei Guo, Tomislav Janjusic, Dmitry Durnov, Michael Blocksome, Min Si, Sangmin Seo, Akhil Langer, Gengbin Zheng, Masamichi Takagi, Paul K. Coffman, Jithin Jose, Sayantan Sur, Alexander Sannikov, Sergey Oblomov, Michael Chuvelev, Masayuki Hatanaka, Xin Zhao, Paul F. Fischer, Thilina Rathnayake, Matthew Otten, Misun Min, Pavan Balaji |
| 2016 | CLUSTER | A Review of Lightweight Thread Approaches for High Performance Computing. | Adrin Castell, Antonio J. Pea, Sangmin Seo, Rafael Mayo, Pavan Balaji, Enrique S. Quintana-Ort |
| 2016 | CLUSTER | Compiler-Assisted Overlapping of Communication and Computation in MPI Applications. | Jichi Guo, Qing Yi, Jiayuan Meng, Junchao Zhang, Pavan Balaji |
| 2016 | ICPP | One-Sided Interface for Matrix Operations Using MPI-3 RMA: A Case Study with Elemental. | Sayan Ghosh, Jeff R. Hammond, Antonio J. Pea, Pavan Balaji, Assefaw Hadish Gebremedhin, Barbara M. Chapman |
| 2016 | ICPP | SWAP-Assembler 2: Optimization of De Novo Genome Assembler at Extreme Scale. | Jintao Meng, Sangmin Seo, Pavan Balaji, Yanjie Wei, Bingqiang Wang, Shengzhong Feng |
| 2016 | ISPDC | Scalability Challenges in Current MPI One-Sided Implementations. | Xin Zhao, Pavan Balaji, William Gropp |
| 2015 | CCGRID | Characterizing MPI and Hybrid MPI+Threads Applications at Scale: Case Study with BFS. | Abdelhalim Amer, Huiwei Lu, Pavan Balaji, Satoshi Matsuoka |
| 2015 | CCGRID | Lessons Learned Implementing User-Level Failure Mitigation in MPICH. | Wesley Bland, Huiwei Lu, Sangmin Seo, Pavan Balaji |
| 2015 | CCGRID | SWAP-Assembler 2: Scalable Genome Assembler towards Millions of Cores - Practice and Experience. | Jintao Meng, Yanjie Wei, Sangmin Seo, Pavan Balaji |
| 2015 | CCGRID | Understanding Data Access Patterns Using Object-Differentiated Memory Profiling. | Antonio J. Pea, Pavan Balaji |
| 2015 | CCGRID | Toward Implementing Robust Support for Portals 4 Networks in MPICH. | Ken Raffenetti, Antonio J. Pea, Pavan Balaji |
| 2015 | CCGRID | Implementation and Evaluation of MPI Nonblocking Collective I/O. | Sangmin Seo, Robert Latham, Junchao Zhang, Pavan Balaji |
| 2015 | CCGRID | Techniques for Enabling Highly Efficient Message Passing on Many-Core Architectures. | Min Si, Pavan Balaji, Yutaka Ishikawa |
| 2015 | CCGRID | Scaling NWChem with Efficient and Portable Asynchronous Communication in MPI RMA. | Min Si, Antonio J. Pea, Jeff R. Hammond, Pavan Balaji, Yutaka Ishikawa |
| 2015 | CCGRID | Accurate Scoring of Drug Conformations at the Extreme Scale. | Boyu Zhang, Trilce Estrada, Pietro Cicotti, Pavan Balaji, Michela Taufer |
| 2015 | CCGRID | Runtime Support for Irregular Computation in MPI-Based Applications. | Xin Zhao, Pavan Balaji, William Gropp |
| 2015 | CCGRID | Analyzing MPI-3.0 Process-Level Shared Memory: A Case Study with Stencil Computations. | Xiaomin Zhu, Junchao Zhang, Kazutomo Yoshii, Shigang Li, Yunquan Zhang, Pavan Balaji |
| 2015 | CLUSTER | Automatic Command Queue Scheduling for Task-Parallel Workloads in OpenCL. | Ashwin Mandayam Aji, Antonio J. Pea, Pavan Balaji, Wu-chun Feng |
| 2015 | CLUSTER | Flexible Error Recovery Using Versions in Global View Resilience. | Nan Dun, Hajime Fujita, Aiman Fang, Yan Liu, Andrew A. Chien, Pavan Balaji, Kamil Iskra, Wesley Bland, Andrew R. Siegel |
| 2015 | CLUSTER | Empirical Comparison of Three Versioning Architectures. | Hajime Fujita, Kamil Iskra, Pavan Balaji, Andrew A. Chien |
| 2015 | CLUSTER | Exploring the Suitability of Remote GPGPU Virtualization for the OpenACC Programming Model Using rCUDA. | Adrin Castell, Antonio J. Pea, Rafael Mayo, Pavan Balaji, Enrique S. Quintana-Ort |
| 2015 | HPCC | MPI+ULT: Overlapping Communication and Computation with User-Level Threads. | Huiwei Lu, Sangmin Seo, Pavan Balaji |
| 2015 | ICCS | Versioned Distributed Arrays for Resilience in Scientific Applications: Global View Resilience. | Andrew A. Chien, Pavan Balaji, Peter H. Beckman, Nan Dun, Aiman Fang, Hajime Fujita, Kamil Iskra, Zachary A. Rubenstein, Ziming Zheng, Rob Schreiber, Jeff R. Hammond, James Dinan, Ignacio Laguna, D. Richards, Anshu Dubey, Brian van Straalen, Mark Hoemmen, Michael A. Heroux, Keita Teranishi, Andrew R. Siegel |
| 2015 | ICPADS | Versioning Architectures for Local and Global Memory. | Hajime Fujita, Kamil Iskra, Pavan Balaji, Andrew A. Chien |
| 2015 | PPoPP | MPI+Threads: runtime contention and remedies. | Abdelhalim Amer, Huiwei Lu, Yanjie Wei, Pavan Balaji, Satoshi Matsuoka |
| 2015 | SC | Fault tolerant MapReduce-MPI for HPC clusters. | Yanfei Guo, Wesley Bland, Pavan Balaji, Xiaobo Zhou |
| 2015 | SC | VOCL-FT: introducing techniques for efficient soft error coprocessor recovery. | Antonio J. Pea, Wesley Bland, Pavan Balaji |
| 2015 | SC | Improving concurrency and asynchrony in multithreaded MPI applications using software offloading. | Karthikeyan Vaidyanathan, Dhiraj D. Kalamkar, Kiran Pamnany, Jeff R. Hammond, Pavan Balaji, Dipankar Das, Jongsoo Park, Blint Jo |
| 2014 | CLUSTER | Toward the efficient use of multiple explicitly managed memory subsystems. | Antonio J. Pea, Pavan Balaji |
| 2014 | ICPADS | WorkQ: A many-core producer/consumer execution model applied to PGAS computations. | David Ozog, Allen D. Malony, Jeff R. Hammond, Pavan Balaji |
| 2014 | ICS | MT-MPI: multithreaded MPI for many-core environments. | Min Si, Antonio J. Pea, Pavan Balaji, Masamichi Takagi, Yutaka Ishikawa |
| 2014 | PPoPP | Portable, MPI-interoperable coarray fortran. | Chaoran Yang, Wesley Bland, John M. Mellor-Crummey, Pavan Balaji |
| 2014 | SC | Simplifying the recovery model of user-level failure mitigation. | Wesley Bland, Kenneth Raffenetti, Pavan Balaji |
| 2014 | SC | MC-Checker: Detecting Memory Consistency Errors in MPI One-Sided Applications. | Zhezhe Chen, James Dinan, Zhen Tang, Pavan Balaji, Hua Zhong, Jun Wei, Tao Huang, Feng Qin |
| 2014 | SC | Nonblocking Epochs in MPI One-Sided Communication. | Judicael A. Zounmevo, Xin Zhao, Pavan Balaji, William Gropp, Ahmad Afsahi |
| 2013 | CCGRID | Optimizing Burrows-Wheeler Transform-Based Sequence Alignment on Multicore Architectures. | Jing Zhang, Heshan Lin, Pavan Balaji, Wu-chun Feng |
| 2013 | CCGRID | Toward Asynchronous and MPI-Interoperable Active Messages. | Xin Zhao, Darius Buntinas, Judicael A. Zounmevo, James Dinan, David Goodell, Pavan Balaji, Rajeev Thakur, Ahmad Afsahi, William Gropp |
| 2013 | DASC | Optimization Strategies for MPI-Interoperable Active Messages. | Xin Zhao, Pavan Balaji, William Gropp, Rajeev Thakur |
| 2013 | EuroPar | Topic 15: GPU and Accelerator Computing - (Introduction). | Naoya Maruyama, Leif Kobbelt, Pavan Balaji, Nikola Puzovic, Samuel Thibault, Kun Zhou |
| 2013 | HPCC | On the Reproducibility of MPI Reduction Operations. | Pavan Balaji, Dries Kimpe |
| 2013 | HPDC | On the efficacy of GPU-integrated MPI for scientific applications. | Ashwin M. Aji, Lokendra S. Panwar, Feng Ji, Milind Chabbi, Karthik Murthy, Pavan Balaji, Keith R. Bisset, James Dinan, Wu-chun Feng, John M. Mellor-Crummey, Xiaosong Ma, Rajeev Thakur |
| 2013 | ICDCS | pVOCL: Power-Aware Dynamic Placement and Migration in Virtualized GPU Environments. | Palden Lama, Yan Li, Ashwin M. Aji, Pavan Balaji, James Dinan, Shucai Xiao, Yunquan Zhang, Wu-chun Feng, Rajeev Thakur, Xiaobo Zhou |
| 2013 | ICPADS | Online Performance Projection for Clusters with Heterogeneous GPUs. | Lokendra S. Panwar, Ashwin M. Aji, Jiayuan Meng, Pavan Balaji, Wu-chun Feng |
| 2013 | ICPADS | MPI-Interoperable Generalized Active Messages. | Xin Zhao, Pavan Balaji, William Gropp, Rajeev Thakur |
| 2013 | ICPP | Enhancing Performance Portability of MPI Applications through Annotation-Based Transformations. | Md. Ziaul Haque, Qing Yi, James Dinan, Pavan Balaji |
| 2013 | ICPP | Inspector-Executor Load Balancing Algorithms for Block-Sparse Tensor Contractions. | David Ozog, Jeff R. Hammond, James Dinan, Pavan Balaji, Sameer Shende, Allen D. Malony |
| 2013 | ICS | Inspector/executor load balancing algorithms for block-sparse tensor contractions. | David Ozog, Sameer Shende, Allen D. Malony, Jeff R. Hammond, James Dinan, Pavan Balaji |
| 2012 | CCGRID | Transparent Accelerator Migration in a Virtualized GPU Environment. | Shucai Xiao, Pavan Balaji, James Dinan, Qian Zhu, Rajeev Thakur, Susan Coghlan, Heshan Lin, Gaojin Wen, Jue Hong, Wu-chun Feng |
| 2012 | CLUSTER | Enabling Fast, Noncontiguous GPU Data Movement in Hybrid MPI+GPU Environments. | John Jenkins, James Dinan, Pavan Balaji, Nagiza F. Samatova, Rajeev Thakur |
| 2012 | HPCC | MPI-ACC: An Integrated and Extensible Approach to Data Movement in Accelerator-based Systems. | Ashwin M. Aji, James Dinan, Darius Buntinas, Pavan Balaji, Wu-chun Feng, Keith R. Bisset, Rajeev Thakur |
| 2012 | HPCC | DMA-Assisted, Intranode Communication in GPU Accelerated Systems. | Feng Ji, Ashwin M. Aji, James Dinan, Darius Buntinas, Pavan Balaji, Rajeev Thakur, Wu-chun Feng, Xiaosong Ma |
| 2011 | HiPC | Building algorithmically nonstop fault tolerant MPI programs. | Rui Wang, Erlin Yao, Mingyu Chen, Guangming Tan, Pavan Balaji, Darius Buntinas |
| 2011 | SC | Poster: High-level, one-sided programming models on MPI: a case study with global arrays and NWChem. | James Dinan, Pavan Balaji, Jeff R. Hammond, Sriram Krishnamoorthy, Vinod Tipparaju |
| 2010 | CLUSTER | Minimizing MPI Resource Contention in Multithreaded Multicore Environments. | David Goodell, Pavan Balaji, Darius Buntinas, Gbor Dzsa, William Gropp, Sameer Kumar, Bronis R. de Supinski, Rajeev Thakur |
| 2010 | HiPC | iWARP redefined: Scalable connectionless communication over high-speed Ethernet. | Mohammad J. Rashti, Ryan E. Grant, Ahmad Afsahi, Pavan Balaji |
| 2010 | HiPC | Fault-tolerant communication runtime support for data-centric programming models. | Abhinav Vishnu, Huub J. J. Van Dam, Wibe de Jong, Pavan Balaji, Shuaiwen Song |
| 2010 | HOTI | Designing High-End Computing Systems with InfiniBand and High-Speed Ethernet. | Dhabaleswar K. Panda, Sayantan Sur, Pavan Balaji |
| 2010 | ISPASS | A study of hardware assisted IP over InfiniBand and its impact on enterprise data center performance. | Ryan E. Grant, Pavan Balaji, Ahmad Afsahi |
| 2009 | CCGRID | Natively Supporting True One-Sided Communication in. | Gopalakrishnan Santhanaraman, Pavan Balaji, K. Gopalakrishnan, Rajeev Thakur, William Gropp, Dhabaleswar K. Panda |
| 2009 | HOTI | Tutorial: Infiniband and 10-Gigabit Ethernet for Dummies. | Dhabaleswar K. Panda, Matthew J. Koop, Pavan Balaji |
| 2009 | HOTI | Tutorial: Designing High-End Computing Systems with Infiniband and 10-Gigabit Ethernet. | Dhabaleswar K. Panda, Matthew J. Koop, Pavan Balaji |
| 2009 | ICPADS | Understanding Network Saturation Behavior on Large-Scale Blue Gene/P Systems. | Pavan Balaji, Harish Naik, Narayan Desai |
| 2009 | ICPADS | Evaluation of ConnectX Virtual Protocol Interconnect for Data Centers. | Ryan E. Grant, Ahmad Afsahi, Pavan Balaji |
| 2009 | ICPP | Improving Resource Availability by Relaxing Network Allocation Constraints on Blue Gene/P. | Narayan Desai, Darius Buntinas, Daniel Buettner, Pavan Balaji, Anthony Chan |
| 2009 | ICPP | GePSeA: A General-Purpose Software Acceleration Framework for Lightweight Task Offloading. | Ajeet Singh, Pavan Balaji, Wu-chun Feng |
| 2008 | CLUSTER | Are nonblocking networks really needed for high-end-computing workloads? | Narayan Desai, Pavan Balaji, P. Sadayappan, Mohammad Islam |
| 2008 | HiPC | Sockets Direct Protocol for Hybrid Network Stacks: A Case Study with iWARP over 10G Ethernet. | Pavan Balaji, Sitha Bhagvat, Rajeev Thakur, Dhabaleswar K. Panda |
| 2008 | HiPC | Communication Analysis of Parallel 3D FFT for Flat Cartesian Meshes on Large Blue Gene Systems. | Anthony Chan, Pavan Balaji, William Gropp, Rajeev Thakur |
| 2008 | HiPC | Making a Case for Proactive Flow Control in Optical Circuit-Switched Networks. | Mithilesh Kumar, Vineeta Chaube, Pavan Balaji, Wu-chun Feng, Hyun-Wook Jin |
| 2008 | HPDC | Semantic-based distributed i/o with the paramedic framework. | Pavan Balaji, Wu-chun Feng, Heshan Lin |
| 2008 | ICCCN | Impact of Network Sharing in Multi-Core Architectures. | Ganesh Narayanaswamy, Pavan Balaji, Wu-chun Feng |
| 2008 | PPoPP | Semantics-based distributed I/O for mpiBLAST. | Pavan Balaji, Wu-chun Feng, Jeremy S. Archuleta, Heshan Lin, Rajkumar Kettimuthu, Rajeev Thakur, Xiaosong Ma |
| 2008 | SC | Massively parallel genomic sequence search on the Blue Gene/P architecture. | Heshan Lin, Pavan Balaji, Ruth Poole, Carlos P. Sosa, Xiaosong Ma, Wu-chun Feng |
| 2008 | SC | Asymmetric interactions in symmetric multi-core systems: analysis, enhancements and evaluation. | Thomas Scogland, Pavan Balaji, Wu-chun Feng, Ganesh Narayanaswamy |
| 2007 | CLUSTER | Designing high-end computing systems with InfiniBand and10-Gigabit Ethernet iWARP. | Dhabaleswar K. Panda, Pavan Balaji |
| 2007 | HOTI | An Analysis of 10-Gigabit Ethernet Protocol Stacks in Multicore Environments. | Ganesh Narayanaswamy, Pavan Balaji, Wu-chun Feng |
| 2007 | ICPP | Advanced Flow-control Mechanisms for the Sockets Direct Protocol over InfiniBand. | Pavan Balaji, Sitha Bhagvat, Dhabaleswar K. Panda, Rajeev Thakur, William Gropp |
| 2007 | ICPP | Analyzing and Minimizing the Impact of Opportunity Cost in QoS-aware Job Scheduling. | Mohammad Islam, Pavan Balaji, Gerald Sabin, P. Sadayappan |
| 2007 | SC | Analyzing the impact of supporting out-of-order communication on in-order performance with iWARP. | Pavan Balaji, Wu-chun Feng, Sitha Bhagvat, Dhabaleswar K. Panda, Rajeev Thakur, William Gropp |
| 2005 | CCGRID | Architecture for caching responses with multiple dynamic dependencies in multi-tier data-centers over InfiniBand. | Sundeep Narravula, Pavan Balaji, Karthikeyan Vaidyanathan, Hyun-Wook Jin, Dhabaleswar K. Panda |
| 2005 | CLUSTER | Head-to-TOE Evaluation of High-Performance Sockets over Protocol Offload Engines. | Pavan Balaji, Wu-chun Feng, Qi Gao, Ranjit Noronha, Weikuan Yu, Dhabaleswar K. Panda |
| 2005 | CLUSTER | Supporting iWARP Compatibility and Features for Regular Network Adapters. | Pavan Balaji, Hyun-Wook Jin, Karthikeyan Vaidyanathan, Dhabaleswar K. Panda |
| 2005 | HOTI | Performance Characterization of a 10-Gigabit Ethernet TOE. | Wu-chun Feng, Pavan Balaji, Christopher Baron, Laxmi N. Bhuyan, Dhabaleswar K. Panda |
| 2005 | ISPASS | On the provision of prioritization and soft qos in dynamically reconfigurable shared data-centers over infiniband. | Pavan Balaji, Sundeep Narravula, Karthikeyan Vaidyanathan, Hyun-Wook Jin, Dhabaleswar K. Panda |
| 2004 | CLUSTER | Towards provision of quality of service guarantees in job scheduling. | Mohammad Islam, Pavan Balaji, P. Sadayappan, Dhabaleswar K. Panda |
| 2004 | ISPASS | Sockets Direct Protocol over InfiniBand in clusters: is it beneficial? | Pavan Balaji, Sundeep Narravula, Karthikeyan Vaidyanathan, Savitha Krishnamoorthy, Jiesheng Wu, Dhabaleswar K. Panda |
| 2003 | HPDC | Impact of High Performance Sockets on Data Intensive Applications. | Pavan Balaji, Jiesheng Wu, Tahsin M. Kur, mit V. atalyrek, Dhabaleswar K. Panda, Joel H. Saltz |
| 2003 | JSSPP | QoPS: A QoS Based Scheme for Parallel Job Scheduling. | Mohammad Islam, Pavan Balaji, P. Sadayappan, Dhabaleswar K. Panda |
| 2002 | CLUSTER | High Performance User Level Sockets over Gigabit Ethernet. | Pavan Balaji, Piyush Shivam, Pete Wyckoff, Dhabaleswar K. Panda |