Skip to content

Min Si

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

21

Venues

11

Active years

2012–2026

Best venue rank

A*

Where they publish

Papers

21 indexed papers, newest first.

YearVenueTitleAuthors
2026SIGCOMMConnecting 100K+ GPUs: Building the Communication Stack for Large-Scale LLM Training.Hongyi Zeng, Min Si, Pavan Balaji, Yongzhou Chen, Ching-Hsiang Chu, Adithya Gangidi, Prashanth Kannan, Bingzhe Liu, Saif Hasan, Dong He, Deep Shah, Ashmitha Jeevaraj Shetty, Gregory R. Steinbrecher, Srikanth Sundaresan, Yulun Wang, Yexin Wu, Mingran Yang, Kenny Yu, Minlan Yu, Cen Zhao, Shengbao Zheng, Wesley Bland, Denis Boyda, Suman Gumudavelli, Subodh Iyengar, Daniel Johnson, Cristian Lumezanu, Kai Luo, Rui Miao, Zhe Qu, Venkatraghavan Ramesh, Jingliang Ren, Maxim Samoylov, Jan Seidel, Qiye Tan, Feng Tian, Xinfeng Xie, Jingyi Yang, Yimeng Zhao, Shuqiang Zhang, Tiane Art Zhu
2025HPCAMachine Learning-Guided Memory Optimization for DLRM Inference on Tiered Memory.Jie Ren, Bin Ma, Shuangyan Yang, Benjamin Francis, Ehsan K. Ardestani, Min Si, Dong Li
2025ISCAScaling Llama 3 Training with Efficient Parallelism Strategies.Weiwei Chu, Xinfeng Xie, Jiecao Yu, Jie Wang, Amar Phanishayee, Chunqiang Tang, Yuchen Hao, Jianyu Huang, Mustafa Ozdal, Jun Wang, Vedanuj Goswami, Naman Goyal, Abhishek Kadian, Andrew Gu, Chris Cai, Feng Tian, Xiaodong Wang, Min Si, Pavan Balaji, Ching-Hsiang Chu, Jongsoo Park
2024SCAccelerating Communication in Deep Learning Recommendation Model Training with Dual-Level Adaptive Lossy Compression.Hao Feng, Boyuan Zhang, Fanjiang Ye, Min Si, Ching-Hsiang Chu, Jiannan Tian, Chunxing Yin, Summer Deng, Yuchen Hao, Pavan Balaji, Tong Geng, Dingwen Tao
2023CLUSTERPiP-MColl: Process-in-Process-based Multi-object MPI Collectives.Jiajun Huang, Kaiming Ouyang, Yujia Zhai, Jinyang Liu, Min Si, Ken Raffenetti, Hui Zhou, Atsushi Hori, Zizhong Chen, Yanfei Guo, Rajeev Thakur
2023HPDCAccelerating MPI Collectives with Process-in-Process-based Multi-object Techniques.Jiajun Huang, Kaiming Ouyang, Yujia Zhai, Jinyang Liu, Min Si, Ken Raffenetti, Hui Zhou, Atsushi Hori, Zizhong Chen, Yanfei Guo, Rajeev Thakur
2023ICSSoftware-Hardware Co-design of Heterogeneous SmartNIC System for Recommendation Models Inference and Training.Anqi Guo, Yuchen Hao, Chunshu Wu, Pouya Haghi, Zhenyu Pan, Min Si, Dingwen Tao, Ang Li, Martin C. Herbordt, Tong Geng
2021CLUSTERDaps: A Dynamic Asynchronous Progress Stealing Model for MPI Communication.Kaiming Ouyang, Min Si, Atsushi Hori, Zizhong Chen, Pavan Balaji
2021PPoPPDynamic scaling for low-precision learning.Ruobing Han, Min Si, James Demmel, Yang You
2020SCCAB-MPI: exploring interprocess work-stealing towards balanced MPI communication.Kaiming Ouyang, Min Si, Atsushi Hori, Zizhong Chen, Pavan Balaji
2019ICSSoftware combining to mitigate multithreaded MPI contention.Abdelhalim Amer, Charles Archer, Michael Blocksome, Chongxiao Cao, Michael Chuvelev, Hajime Fujita, Maria Garzaran, Yanfei Guo, Jeff R. Hammond, Shintaro Iwasaki, Kenneth J. Raffenetti, Mikhail Shiryaev, Min Si, Kenjiro Taura, Sagar Thapaliya, Pavan Balaji
2018HPDCProcess-in-process: techniques for practical address-space sharing.Atsushi Hori, Min Si, Balazs Gerofi, Masamichi Takagi, Jai Dayal, Pavan Balaji, Yutaka Ishikawa
2017HPCCTowards Scalable Deep Learning via I/O Analysis and Optimization.Sarunya Pumma, Min Si, Wu-chun Feng, Pavan Balaji
2017HPCCProcess-Based Asynchronous Progress Model for MPI Point-to-Point Communication.Min Si, Pavan Balaji
2017ICPADSParallel I/O Optimizations for Scalable Deep Learning.Sarunya Pumma, Min Si, Wu-chun Feng, Pavan Balaji
2017SCWhy is MPI so slow?: analyzing the fundamental limits in implementing MPI-3.1.Ken Raffenetti, Abdelhalim Amer, Lena Oden, Charles Archer, Wesley Bland, Hajime Fujita, Yanfei Guo, Tomislav Janjusic, Dmitry Durnov, Michael Blocksome, Min Si, Sangmin Seo, Akhil Langer, Gengbin Zheng, Masamichi Takagi, Paul K. Coffman, Jithin Jose, Sayantan Sur, Alexander Sannikov, Sergey Oblomov, Michael Chuvelev, Masayuki Hatanaka, Xin Zhao, Paul F. Fischer, Thilina Rathnayake, Matthew Otten, Misun Min, Pavan Balaji
2015CCGRIDTechniques for Enabling Highly Efficient Message Passing on Many-Core Architectures.Min Si, Pavan Balaji, Yutaka Ishikawa
2015CCGRIDScaling NWChem with Efficient and Portable Asynchronous Communication in MPI RMA.Min Si, Antonio J. Pea, Jeff R. Hammond, Pavan Balaji, Yutaka Ishikawa
2014ICSMT-MPI: multithreaded MPI for many-core environments.Min Si, Antonio J. Pea, Pavan Balaji, Masamichi Takagi, Yutaka Ishikawa
2012SCAbstract: An MPI Library implementing Direct Communication for Many-Core Based Accelerators.Min Si, Yutaka Ishikawa
2012SCPoster: An MPI Library implementing Direct Communication for Many-Core Based Accelerators.Min Si, Yutaka Ishikawa