Min Si
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
21
Venues
11
Active years
2012–2026
Best venue rank
A*
Where they publish
Papers
21 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | SIGCOMM | Connecting 100K+ GPUs: Building the Communication Stack for Large-Scale LLM Training. | Hongyi Zeng, Min Si, Pavan Balaji, Yongzhou Chen, Ching-Hsiang Chu, Adithya Gangidi, Prashanth Kannan, Bingzhe Liu, Saif Hasan, Dong He, Deep Shah, Ashmitha Jeevaraj Shetty, Gregory R. Steinbrecher, Srikanth Sundaresan, Yulun Wang, Yexin Wu, Mingran Yang, Kenny Yu, Minlan Yu, Cen Zhao, Shengbao Zheng, Wesley Bland, Denis Boyda, Suman Gumudavelli, Subodh Iyengar, Daniel Johnson, Cristian Lumezanu, Kai Luo, Rui Miao, Zhe Qu, Venkatraghavan Ramesh, Jingliang Ren, Maxim Samoylov, Jan Seidel, Qiye Tan, Feng Tian, Xinfeng Xie, Jingyi Yang, Yimeng Zhao, Shuqiang Zhang, Tiane Art Zhu |
| 2025 | HPCA | Machine Learning-Guided Memory Optimization for DLRM Inference on Tiered Memory. | Jie Ren, Bin Ma, Shuangyan Yang, Benjamin Francis, Ehsan K. Ardestani, Min Si, Dong Li |
| 2025 | ISCA | Scaling Llama 3 Training with Efficient Parallelism Strategies. | Weiwei Chu, Xinfeng Xie, Jiecao Yu, Jie Wang, Amar Phanishayee, Chunqiang Tang, Yuchen Hao, Jianyu Huang, Mustafa Ozdal, Jun Wang, Vedanuj Goswami, Naman Goyal, Abhishek Kadian, Andrew Gu, Chris Cai, Feng Tian, Xiaodong Wang, Min Si, Pavan Balaji, Ching-Hsiang Chu, Jongsoo Park |
| 2024 | SC | Accelerating Communication in Deep Learning Recommendation Model Training with Dual-Level Adaptive Lossy Compression. | Hao Feng, Boyuan Zhang, Fanjiang Ye, Min Si, Ching-Hsiang Chu, Jiannan Tian, Chunxing Yin, Summer Deng, Yuchen Hao, Pavan Balaji, Tong Geng, Dingwen Tao |
| 2023 | CLUSTER | PiP-MColl: Process-in-Process-based Multi-object MPI Collectives. | Jiajun Huang, Kaiming Ouyang, Yujia Zhai, Jinyang Liu, Min Si, Ken Raffenetti, Hui Zhou, Atsushi Hori, Zizhong Chen, Yanfei Guo, Rajeev Thakur |
| 2023 | HPDC | Accelerating MPI Collectives with Process-in-Process-based Multi-object Techniques. | Jiajun Huang, Kaiming Ouyang, Yujia Zhai, Jinyang Liu, Min Si, Ken Raffenetti, Hui Zhou, Atsushi Hori, Zizhong Chen, Yanfei Guo, Rajeev Thakur |
| 2023 | ICS | Software-Hardware Co-design of Heterogeneous SmartNIC System for Recommendation Models Inference and Training. | Anqi Guo, Yuchen Hao, Chunshu Wu, Pouya Haghi, Zhenyu Pan, Min Si, Dingwen Tao, Ang Li, Martin C. Herbordt, Tong Geng |
| 2021 | CLUSTER | Daps: A Dynamic Asynchronous Progress Stealing Model for MPI Communication. | Kaiming Ouyang, Min Si, Atsushi Hori, Zizhong Chen, Pavan Balaji |
| 2021 | PPoPP | Dynamic scaling for low-precision learning. | Ruobing Han, Min Si, James Demmel, Yang You |
| 2020 | SC | CAB-MPI: exploring interprocess work-stealing towards balanced MPI communication. | Kaiming Ouyang, Min Si, Atsushi Hori, Zizhong Chen, Pavan Balaji |
| 2019 | ICS | Software combining to mitigate multithreaded MPI contention. | Abdelhalim Amer, Charles Archer, Michael Blocksome, Chongxiao Cao, Michael Chuvelev, Hajime Fujita, Maria Garzaran, Yanfei Guo, Jeff R. Hammond, Shintaro Iwasaki, Kenneth J. Raffenetti, Mikhail Shiryaev, Min Si, Kenjiro Taura, Sagar Thapaliya, Pavan Balaji |
| 2018 | HPDC | Process-in-process: techniques for practical address-space sharing. | Atsushi Hori, Min Si, Balazs Gerofi, Masamichi Takagi, Jai Dayal, Pavan Balaji, Yutaka Ishikawa |
| 2017 | HPCC | Towards Scalable Deep Learning via I/O Analysis and Optimization. | Sarunya Pumma, Min Si, Wu-chun Feng, Pavan Balaji |
| 2017 | HPCC | Process-Based Asynchronous Progress Model for MPI Point-to-Point Communication. | Min Si, Pavan Balaji |
| 2017 | ICPADS | Parallel I/O Optimizations for Scalable Deep Learning. | Sarunya Pumma, Min Si, Wu-chun Feng, Pavan Balaji |
| 2017 | SC | Why is MPI so slow?: analyzing the fundamental limits in implementing MPI-3.1. | Ken Raffenetti, Abdelhalim Amer, Lena Oden, Charles Archer, Wesley Bland, Hajime Fujita, Yanfei Guo, Tomislav Janjusic, Dmitry Durnov, Michael Blocksome, Min Si, Sangmin Seo, Akhil Langer, Gengbin Zheng, Masamichi Takagi, Paul K. Coffman, Jithin Jose, Sayantan Sur, Alexander Sannikov, Sergey Oblomov, Michael Chuvelev, Masayuki Hatanaka, Xin Zhao, Paul F. Fischer, Thilina Rathnayake, Matthew Otten, Misun Min, Pavan Balaji |
| 2015 | CCGRID | Techniques for Enabling Highly Efficient Message Passing on Many-Core Architectures. | Min Si, Pavan Balaji, Yutaka Ishikawa |
| 2015 | CCGRID | Scaling NWChem with Efficient and Portable Asynchronous Communication in MPI RMA. | Min Si, Antonio J. Pea, Jeff R. Hammond, Pavan Balaji, Yutaka Ishikawa |
| 2014 | ICS | MT-MPI: multithreaded MPI for many-core environments. | Min Si, Antonio J. Pea, Pavan Balaji, Masamichi Takagi, Yutaka Ishikawa |
| 2012 | SC | Abstract: An MPI Library implementing Direct Communication for Many-Core Based Accelerators. | Min Si, Yutaka Ishikawa |
| 2012 | SC | Poster: An MPI Library implementing Direct Communication for Many-Core Based Accelerators. | Min Si, Yutaka Ishikawa |