Skip to content

Mohamed Wahib

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

50

Venues

17

Active years

2007–2026

Best venue rank

A

Where they publish

Papers

50 indexed papers, newest first.

YearVenueTitleAuthors
2026CGOFRUGAL: Pushing GPU Applications beyond Memory Limits.Lingqi Zhang, Tengfei Wang, Jiajun Huang, Chen Zhuang, Ivan R. Ivanov, Peng Chen, Toshio Endo, Mohamed Wahib
2026ICSSHIRO: Near-Optimal Communication Strategies for Distributed Sparse Matrix Multiplication.Chen Zhuang, Lingqi Zhang, Benjamin Brock, Du Wu, Peng Chen, Toshio Endo, Satoshi Matsuoka, Mohamed Wahib
2025ICSA Device-Side Execution Model for Multi-GPU Task Graphs.Ilyas Turimbetov, Mohamed Wahib, Didem Unat
2025ICSScaling Large-scale GNN Training to Thousands of Processors on CPU-based Supercomputers.Chen Zhuang, Lingqi Zhang, Du Wu, Peng Chen, Jiajun Huang, Xin Liu, Rio Yokota, Nikoli Dryden, Toshio Endo, Satoshi Matsuoka, Mohamed Wahib
2025PPoPPA General and Scalable GCN Training Framework on CPU Supercomputers.Chen Zhuang, Peng Chen, Xin Liu, Rio Yokota, Nikoli Dryden, Lingqi Zhang, Toshio Endo, Satoshi Matsuoka, Mohamed Wahib
2025SCA Sample-Free Compilation Framework for Efficient Dynamic Tensor Computation.Yangjie Zhou, Honglin Zhu, Qian Qiu, Weihao Cui, Zihan Liu, Peng Chen, Mohamed Wahib, Cong Guo, Siyuan Feng, Jintao Meng, Haidong Lan, Jingwen Leng, Yun Lin, Jin Song Dong, Wenxi Zhu, Minwen Deng
2025SCORBIT-2: Scaling Exascale Vision Foundation Models for Weather and Climate Downscaling.Xiao Wang, Jong-Youl Choi, Takuya Kurihana, Isaac Lyngaas, Hong-Jun Yoon, Xi Xiao, David Pugmire, Ming Fan, Nasik Muhammad Nafi, Aristeidis Tsaris, Ashwin M. Aji, Maliha Hossain, Mohamed Wahib, Dali Wang, Peter E. Thornton, Prasanna Balaprakash, Moetasim Ashfaq, Dan Lu
2025SCRAPTOR: Practical Numerical Profiling of Scientific Applications.Faveo Hoerold, Ivan R. Ivanov, Akash Dhruv, William S. Moses, Anshu Dubey, Mohamed Wahib, Jens Domke
2025SCDistributed Cross-Channel Hierarchical Aggregation for Foundation Models.Aristeidis Tsaris, Isaac Lyngaas, John H. Lagergren, Mohamed Wahib, Larry M. York, Prasanna Balaprakash, Dan Lu, Feiyi Wang, Xiao Wang
2025SCBalanced and Elastic End-to-end Training of Dynamic LLMs.Mohamed Wahib, Muhammed Abdullah Soyturk, Didem Unat
2024CLUSTERWelcome Message from the IEEE Cluster 2024 Program Chairs.Yutong Lu, Wu-chun Feng, Mohamed Wahib
2024CLUSTERAsynchronous I/O Optimization for X-Ray Imaging via GPUDirect Storage.Du Wu, Peng Chen, Yiyu Tan, Yusuke Tanimura, Toshio Endo, Satoshi Matsuoka, Mohamed Wahib
2024CLUSTERInvestigating Nvidia GPU Architecture Trends via Microbenchmarks.Lingqi Zhang, Ryan Barton, Peng Chen, Xiao Wang, Toshio Endo, Satoshi Matsuoka, Mohamed Wahib
2024CLUSTERCommunication Optimization for Distributed GCN Training on ABCI Supercomputer.Chen Zhuang, Peng Chen, Xin Liu, Toshio Endo, Satoshi Matsuoka, Mohamed Wahib
2024IJCNNProgressive Neural Predictor with Score-Based Sampling.Liwen Jiang, Yu Xue, Ferrante Neri, Xiaoping Zhao, Mohamed Wahib
2024IJCNNValidation Loss Landscape Exploration with Deep Q-Learning.Enzhi Zhang, Rui Zhong, Masaharu Munetomo, Mohamed Wahib
2024ICSReal-time High-resolution X-Ray Computed Tomography.Du Wu, Peng Chen, Xiao Wang, Isaac Lyngaas, Takaaki Miyajima, Toshio Endo, Satoshi Matsuoka, Mohamed Wahib
2024SCautoGEMM: Pushing the Limits of Irregular Matrix Multiplication on Arm Architectures.Du Wu, Jintao Meng, Wenxi Zhu, Minwen Deng, Xiao Wang, Tao Luo, Mohamed Wahib, Yanjie Wei
2024SCAdaptive Patching for High-resolution Image Segmentation with Transformers.Enzhi Zhang, Isaac Lyngaas, Peng Chen, Xiao Wang, Jun Igarashi, Yuankai Huo, Masaharu Munetomo, Mohamed Wahib
2023ICSMulti-GPU Communication Schemes for Iterative Solvers: When CPUs are Not in Charge.Ismayil Ismayilov, Javid Baydamirli, Dogan Sagbili, Mohamed Wahib, Didem Unat
2023ICSPERKS: a Locality-Optimized Execution Model for Iterative Memory-bound GPU Applications.Lingqi Zhang, Mohamed Wahib, Peng Chen, Jintao Meng, Xiao Wang, Toshio Endo, Satoshi Matsuoka
2023ICSRevisiting Temporal Blocking Stencil Optimizations.Lingqi Zhang, Mohamed Wahib, Peng Chen, Jintao Meng, Xiao Wang, Toshio Endo, Satoshi Matsuoka
2023SMCTraining Knowledge Inheritance Through Deep Q-Net.Enzhi Zhang, Ruqin Wang, Mohamed Wahib, Rui Zhong, Masaharu Munetomo
2022SCImage Gradient Decomposition for Parallel and Memory-Efficient Ptychographic Reconstruction.Xiao Wang, Aristeidis Tsaris, Debangshu Mukherjee, Mohamed Wahib, Peng Chen, Mark Oxley, Olga Ovchinnikova, Jacob D. Hinkle
2021CCGRIDAn Allreduce Algorithm and Network Co-design for Large-Scale Training of Distributed Deep Learning.Truong Thao Nguyen, Mohamed Wahib
2021EuroParDomain-Specific Runtime to Orchestrate Computation on Heterogeneous Platforms.Jared O'Neal, Mohamed Wahib, Anshu Dubey, Klaus Weide, Tom Klosterman, Johann Rudi
2021HPDCAn Oracle for Guiding Large-Scale Model/Hybrid Parallel Training of Convolutional Neural Networks.Albert Njoroge Kahira, Truong Thao Nguyen, Leonardo Bautista-Gomez, Ryousei Takano, Rosa M. Badia, Mohamed Wahib
2021ICPPIntra-page Cache Update in SLC-mode with Partial Programming in High Density SSDs.Jun Li, Minjun Li, Zhigang Cai, Franois Trahay, Mohamed Wahib, Balazs Gerofi, Zhiming Liu, Min Huang, Jianwei Liao
2021ICSPerformance portable back-projection algorithms on CPUs: agnostic data locality and vectorization optimizations.Peng Chen, Mohamed Wahib, Xiao Wang, Shin'ichiro Takizawa, Takahiro Hirofuchi, Hirotaka Ogawa, Satoshi Matsuoka
2021SCScalable FBP decomposition for cone-beam CT reconstruction.Peng Chen, Mohamed Wahib, Xiao Wang, Takahiro Hirofuchi, Hirotaka Ogawa, Ander Biguri, Richard P. Boardman, Thomas Blumensath, Satoshi Matsuoka
2020CGOAN5D: automated stencil framework for high-degree temporal blocking on GPUs.Kazuaki Matsumura, Hamid Reza Zohouri, Mohamed Wahib, Toshio Endo, Satoshi Matsuoka
2020SCScaling distributed deep learning workloads beyond the memory capacity with KARMA.Mohamed Wahib, Haoyu Zhang, Truong Thao Nguyen, Aleksandr Drozd, Jens Domke, Lingqi Zhang, Ryousei Takano, Satoshi Matsuoka
2019IPCCCTopology-aware Sparse Allreduce for Large-scale Deep Learning.Truong Thao Nguyen, Mohamed Wahib, Ryousei Takano
2019SCA versatile software systolic execution model for GPU memory-bound kernels.Peng Chen, Mohamed Wahib, Shin'ichiro Takizawa, Ryousei Takano, Satoshi Matsuoka
2019SCiFDK: a scalable framework for instant high-resolution image reconstruction.Peng Chen, Mohamed Wahib, Shin'ichiro Takizawa, Ryousei Takano, Satoshi Matsuoka
2018CLUSTEREfficient Algorithms for the Summed Area Tables Primitive on GPUs.Peng Chen, Mohamed Wahib, Shin'ichiro Takizawa, Ryousei Takano, Satoshi Matsuoka
2016SCDaino: a high-level framework for parallel and efficient AMR on GPUs.Mohamed Wahib, Naoya Maruyama, Takayuki Aoki
2015HPDCAutomated GPU Kernel Transformations in Large-Scale Production Stencil Applications.Mohamed Wahib, Naoya Maruyama
2015SCData-centric GPU-based adaptive mesh refinement.Mohamed Wahib, Naoya Maruyama
2014SCScalable Kernel Fusion for Memory-Bound GPU Applications.Mohamed Wahib, Naoya Maruyama
2013CLUSTERHighly optimized full GPU-acceleration of non-hydrostatic weather model SCALE-LES.Mohamed Wahib, Naoya Maruyama
2011CECAdvanced genetic algorithm to solve MINLP problems over GPU.Asim Munawar, Mohamed Wahib, Masaharu Munetomo, Kiyoshi Akama
2011CECOptimization of parallel Genetic Algorithms for nVidia GPUs.Mohamed Wahib, Asim Munawar, Masaharu Munetomo, Kiyoshi Akama
2011SERVICESA Framework for Cloud Embedded Web Services Utilized by Cloud Applications.Mohamed Wahib, Asim Munawar, Masaharu Munetomo, Kiyoshi Akama
2010CECA Bayesian Optimization Algorithm for De Novo ligand design based docking running over GPU.Mohamed Wahib, Asim Munawar, Masaharu Munetomo, Kiyoshi Akama
2010PDPTAA Light Framework for the Unified Representation and Execution of Variant Tasks in a Grid Based Environment.Mohamed Wahib, Asim Munawar, Masaharu Munetomo, Kiyoshi Akama
2009PDCATTheoretical and Empirical Analysis of a GPU Based Parallel Bayesian Optimization Algorithm.Asim Munawar, Mohamed Wahib, Masaharu Munetomo, Kiyoshi Akama
2008HPCCSolving Large Instances of Capacitated Vehicle Routing Problem over Cell BE.Asim Munawar, Mohamed Wahib, Masaharu Munetomo, Kiyoshi Akama
2008HPCCA Survey: Genetic Algorithms and the Fast Evolving World of Parallel Computing.Asim Munawar, Mohamed Wahib, Masaharu Munetomo, Kiyoshi Akama
2007PDCATMHGrid: Towards an Ideal Optimization Environment for Global Optimization Problems Using Grid Computing.Mohamed Wahib, Asim Munawar, Masaharu Munetomo, Kiyoshi Akama