| 2024 | CLUSTER | Preliminary Performance Evaluation of Grace-Hopper GH200. | Toshihiro Hanawa, Kengo Nakajima, Yohei Miki, Takashi Shimokawabe, Kazuya Yamazaki, Shinji Sumimoto, Osamu Tatebe, Taisuke Boku, Daisuke Takahashi, Akira Nukada, Norihisa Fujita, Ryohei Kobayashi, Hiroto Tadano, Akira Naruse |
| 2024 | CLUSTER | FCUFS: Core-Level Frequency Tuning for Energy Optimization on Intel Processors. | Hongjian Zhang, Akira Nukada, Qiucheng Liao |
| 2022 | PPoPP | Accelerating data transfer between host and device using idle GPU. | Yuya Tatsugi, Akira Nukada |
| 2019 | CCGRID | Batched Sparse Matrix Multiplication for Accelerating Graph Convolutional Networks. | Yusuke Nagasaka, Akira Nukada, Ryosuke Kojima, Satoshi Matsuoka |
| 2018 | CCGRID | Optimizing Preconditioned Conjugate Gradient on TaihuLight for OpenFOAM. | James Lin, Minhua Wen, Delong Meng, Xin Liu, Akira Nukada, Satoshi Matsuoka |
| 2017 | ICPP | Optimizations of Two Compute-Bound Scientific Kernels on the SW26010 Many-Core Processor. | James Lin, Zhigeng Xu, Akira Nukada, Naoya Maruyama, Satoshi Matsuoka |
| 2017 | ICPP | High-Performance and Memory-Saving Sparse General Matrix-Matrix Multiplication for NVIDIA Pascal GPU. | Yusuke Nagasaka, Akira Nukada, Satoshi Matsuoka |
| 2016 | ICCS | Adaptive Multi-level Blocking Optimization for Sparse Matrix Vector Multiplication on GPU. | Yusuke Nagasaka, Akira Nukada, Satoshi Matsuoka |
| 2015 | CCGRID | Modeling Gather and Scatter with Hardware Performance Counters for Xeon Phi. | James Lin, Akira Nukada, Satoshi Matsuoka |
| 2015 | EuroPar | Efficient Execution of Multiple CUDA Applications Using Transparent Suspend, Resume and Migration. | Taichiro Suzuki, Akira Nukada, Satoshi Matsuoka |
| 2014 | ICPADS | TSUBAME-KFC: A modern liquid submersion cooling prototype towards exascale becoming the greenest supercomputer in the world. | Toshio Endo, Akira Nukada, Satoshi Matsuoka |
| 2014 | ICPADS | Cache-aware sparse matrix formats for Kepler GPU. | Yusuke Nagasaka, Akira Nukada, Satoshi Matsuoka |
| 2012 | ASPLOS | High performance 3-D FFT using multiple CUDA GPUs. | Akira Nukada, Yutaka Maruyama, Satoshi Matsuoka |
| 2012 | SC | Scalable multi-GPU 3-D FFT for TSUBAME 2.0 supercomputer. | Akira Nukada, Kento Sato, Satoshi Matsuoka |
| 2011 | BMVC | Hamming Color Code for Dense and Robust One-shot 3D Scanning. | Shuntaro Yamazaki, Akira Nukada, Masaaki Mochimaru |
| 2011 | SC | Peta-scale phase-field simulation for dendritic solidification on the TSUBAME 2.0 supercomputer. | Takashi Shimokawabe, Takayuki Aoki, Tomohiro Takaki, Toshio Endo, Akinori Yamanaka, Naoya Maruyama, Akira Nukada, Satoshi Matsuoka |
| 2010 | HiPC | Low-overhead diskless checkpoint for hybrid computing systems. | Leonardo Arturo Bautista-Gomez, Akira Nukada, Naoya Maruyama, Franck Cappello, Satoshi Matsuoka |
| 2010 | SC | An 80-Fold Speedup, 15.0 TFlops Full GPU Acceleration of Non-Hydrostatic Weather Model ASUCA Production Code. | Takashi Shimokawabe, Takayuki Aoki, Chiashi Muroi, Junichi Ishida, Kohei Kawano, Toshio Endo, Akira Nukada, Naoya Maruyama, Satoshi Matsuoka |
| 2009 | ASPDAC | Aspects of GPU for general purpose high performance computing. | Reiji Suda, Takayuki Aoki, Shoichi Hirasawa, Akira Nukada, Hiroki Honda, Satoshi Matsuoka |
| 2009 | ICCS | Fast Conjugate Gradients with Multiple GPUs. | Ali Cevahir, Akira Nukada, Satoshi Matsuoka |
| 2009 | SC | Auto-tuning 3-D FFT library for CUDA GPUs. | Akira Nukada, Satoshi Matsuoka |
| 2008 | SC | Bandwidth intensive 3-D FFT kernel for GPUs using CUDA. | Akira Nukada, Yasuhiko Ogata, Toshio Endo, Satoshi Matsuoka |
| 2007 | HPCC | High Performance FFT on SGI Altix 3700. | Akira Nukada, Daisuke Takahashi, Reiji Suda, Akira Nishida |
| 2007 | ISPA | High Performance 3D Convolution for Protein Docking on IBM Blue Gene. | Akira Nukada, Yuichiro Hourai, Akira Nishida, Yutaka Akiyama |
| 2007 | PPAM | Cloth Simulation in the SILC Matrix Computation Framework: A Case Study. | Tamito Kajiyama, Akira Nukada, Reiji Suda, Hidehiko Hasegawa, Akira Nishida |
| 2006 | ICASSP | FFTSS: A High Performance Fast Fourier Transform Library. | Akira Nukada |
| 2006 | SC | Poster reception - Scalable software infrastructure project. | Akira Nishida, Hisashi Kotakemori, Tamito Kajiyama, Akira Nukada |
| 2005 | PPAM | SILC: A Flexible and Environment-Independent Interface for Matrix Computation Libraries. | Tamito Kajiyama, Akira Nukada, Hidehiko Hasegawa, Reiji Suda, Akira Nishida |