Olatunji Ruwase
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
22
Venues
12
Active years
2004–2026
Best venue rank
A*
Where they publish
Papers
22 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ASPLOS | SuperOffload: Unleashing the Power of Large-Scale LLM Training on Superchips. | Xinyu Lian, Masahiro Tanaka, Olatunji Ruwase, Minjia Zhang |
| 2025 | USENIX | Universal Checkpointing: A Flexible and Efficient Distributed Checkpointing System for Large-Scale DNN Training with Reconfigurable Parallelism. | Xinyu Lian, Sam Ade Jacobs, Lev Kurilenko, Masahiro Tanaka, Stas Bekman, Olatunji Ruwase, Minjia Zhang |
| 2024 | ICLR | ZeRO++: Extremely Efficient Collective Communication for Large Model Training. | Guanhua Wang, Heyang Qin, Sam Ade Jacobs, Xiaoxia Wu, Connor Holmes, Zhewei Yao, Samyam Rajbhandari, Olatunji Ruwase, Feng Yan, Lei Yang, Yuxiong He |
| 2024 | SC | RecFlex: Enabling Feature Heterogeneity-Aware Optimization for Deep Recommendation Models with Flexible Schedules. | Zaifeng Pan, Zhen Zheng, Feng Zhang, Bing Xie, Ruofan Wu, Shaden Smith, Chuanjie Liu, Olatunji Ruwase, Xiaoyong Du, Yufei Ding |
| 2024 | USENIX | Quant-LLM: Accelerating the Serving of Large Language Models via FP6-Centric Algorithm-System Co-Design on Modern GPUs. | Haojun Xia, Zhen Zheng, Xiaoxia Wu, Shiyang Chen, Zhewei Yao, Stephen Youn, Arash Bakhtiari, Michael Wyatt, Donglin Zhuang, Zhongzhu Zhou, Olatunji Ruwase, Yuxiong He, Shuaiwen Leon Song |
| 2023 | ICS | A Hybrid Tensor-Expert-Data Parallelism Approach to Optimize Mixture-of-Experts Training. | Siddharth Singh, Olatunji Ruwase, Ammar Ahmad Awan, Samyam Rajbhandari, Yuxiong He, Abhinav Bhatele |
| 2022 | SC | DeepSpeed- Inference: Enabling Efficient Inference of Transformer Models at Unprecedented Scale. | Reza Yazdani Aminabadi, Samyam Rajbhandari, Ammar Ahmad Awan, Cheng Li, Du Li, Elton Zheng, Olatunji Ruwase, Shaden Smith, Minjia Zhang, Jeff Rasley, Yuxiong He |
| 2021 | SC | ZeRO-infinity: breaking the GPU memory wall for extreme scale deep learning. | Samyam Rajbhandari, Olatunji Ruwase, Jeff Rasley, Shaden Smith, Yuxiong He |
| 2021 | USENIX | ZeRO-Offload: Democratizing Billion-Scale Model Training. | Jie Ren, Samyam Rajbhandari, Reza Yazdani Aminabadi, Olatunji Ruwase, Shuangyan Yang, Minjia Zhang, Dong Li, Yuxiong He |
| 2020 | KDD | DeepSpeed: System Optimizations Enable Training Deep Learning Models with Over 100 Billion Parameters. | Jeff Rasley, Samyam Rajbhandari, Olatunji Ruwase, Yuxiong He |
| 2020 | SC | ZeRO: memory optimizations toward training trillion parameter models. | Samyam Rajbhandari, Jeff Rasley, Olatunji Ruwase, Yuxiong He |
| 2017 | ASPLOS | Optimizing CNNs on Multicores for Scalability, Performance and Goodput. | Samyam Rajbhandari, Yuxiong He, Olatunji Ruwase, Michael Carbin, Trishul M. Chilimbi |
| 2017 | Middleware | HyperDrive: exploring hyperparameters with POP scheduling. | Jeff Rasley, Yuxiong He, Feng Yan, Olatunji Ruwase, Rodrigo Fonseca |
| 2016 | SC | SERF: efficient scheduling for fast deep neural network serving via judicious parallelism. | Feng Yan, Yuxiong He, Olatunji Ruwase, Evgenia Smirni |
| 2015 | ISCA | Page overlays: an enhanced virtual memory framework to enable fine-grained memory management. | Vivek Seshadri, Gennady Pekhimenko, Olatunji Ruwase, Onur Mutlu, Phillip B. Gibbons, Michael A. Kozuch, Todd C. Mowry, Trishul M. Chilimbi |
| 2015 | KDD | Performance Modeling and Scalability Optimization of Distributed Deep Learning Systems. | Feng Yan, Olatunji Ruwase, Yuxiong He, Trishul M. Chilimbi |
| 2014 | ASPLOS | Guardrail: a high fidelity approach to protecting hardware devices from buggy drivers. | Olatunji Ruwase, Michael A. Kozuch, Phillip B. Gibbons, Todd C. Mowry |
| 2010 | PLDI | Decoupled lifeguards: enabling path optimizations for dynamic correctness checking tools. | Olatunji Ruwase, Shimin Chen, Phillip B. Gibbons, Todd C. Mowry |
| 2008 | ISCA | Flexible Hardware Acceleration for Instruction-Grain Program Monitoring. | Shimin Chen, Michael Kozuch, Theodoros Strigkos, Babak Falsafi, Phillip B. Gibbons, Todd C. Mowry, Vijaya Ramachandran, Olatunji Ruwase, Michael P. Ryan, Evangelos Vlachos |
| 2008 | MOBICOM | Ditto: a system for opportunistic caching in multi-hop wireless networks. | Fahad R. Dogar, Amar Phanishayee, Himabindu Pucha, Olatunji Ruwase, David G. Andersen |
| 2008 | SPAA | Parallelizing dynamic information flow tracking. | Olatunji Ruwase, Phillip B. Gibbons, Todd C. Mowry, Vijaya Ramachandran, Shimin Chen, Michael Kozuch, Michael P. Ryan |
| 2004 | NDSS | A Practical Dynamic Buffer Overflow Detector. | Olatunji Ruwase, Monica S. Lam |