| 2024 | Interspeech | FLEURS-R: A Restored Multilingual Speech Corpus for Generation Tasks. | Min Ma, Yuma Koizumi, Shigeki Karita, Heiga Zen, Jason Riesa, Haruko Ishikawa, Michiel Bacchiani |
| 2023 | Interspeech | LibriTTS-R: A Restored Multi-Speaker Text-to-Speech Corpus. | Yuma Koizumi, Heiga Zen, Shigeki Karita, Yifan Ding, Kohei Yatabe, Nobuyuki Morioka, Michiel Bacchiani, Yu Zhang, Wei Han, Ankur Bapna |
| 2022 | Interspeech | SNRi Target Training for Joint Speech Enhancement and Recognition. | Yuma Koizumi, Shigeki Karita, Arun Narayanan, Sankaran Panchapagesan, Michiel Bacchiani |
| 2022 | Interspeech | SpecGrad: Diffusion Probabilistic Model based Neural Vocoder with Adaptive Noise Spectral Shaping. | Yuma Koizumi, Heiga Zen, Kohei Yatabe, Nanxin Chen, Michiel Bacchiani |
| 2020 | ICASSP | Sound Event Detection by Multitask Learning of Sound Events and Scenes with Soft Scene Labels. | Keisuke Imoto, Noriyuki Tonami, Yuma Koizumi, Masahiro Yasuda, Ryosuke Yamanishi, Yoichi Yamashita |
| 2020 | ICASSP | Stable Training of Dnn for Speech Enhancement Based on Perceptually-Motivated Black-Box Cost Function. | Masaki Kawanaka, Yuma Koizumi, Ryoichi Miyazaki, Kohei Yatabe |
| 2020 | ICASSP | Speech Enhancement Using Self-Adaptation and Multi-Head Self-Attention. | Yuma Koizumi, Kohei Yatabe, Marc Delcroix, Yoshiki Masuyama, Daiki Takeuchi |
| 2020 | ICASSP | SPIDERnet: Attention Network For One-Shot Anomaly Detection In Sounds. | Yuma Koizumi, Masahiro Yasuda, Shin Murata, Shoichiro Saito, Hisashi Uematsu, Noboru Harada |
| 2020 | ICASSP | Phase Reconstruction Based On Recurrent Phase Unwrapping With Deep Neural Networks. | Yoshiki Masuyama, Kohei Yatabe, Yuma Koizumi, Yasuhiro Oikawa, Noboru Harada |
| 2020 | ICASSP | Real-Time Speech Enhancement Using Equilibriated RNN. | Daiki Takeuchi, Kohei Yatabe, Yuma Koizumi, Yasuhiro Oikawa, Noboru Harada |
| 2020 | ICASSP | Invertible DNN-Based Nonlinear Time-Frequency Transform for Speech Enhancement. | Daiki Takeuchi, Kohei Yatabe, Yuma Koizumi, Yasuhiro Oikawa, Noboru Harada |
| 2020 | ICASSP | Sound Event Localization Based on Sound Intensity Vector Refined by Dnn-Based Denoising and Source Separation. | Masahiro Yasuda, Yuma Koizumi, Shoichiro Saito, Hisashi Uematsu, Keisuke Imoto |
| 2020 | Interspeech | A Transformer-Based Audio Captioning Model with Keyword Estimation. | Yuma Koizumi, Ryo Masumura, Kyosuke Nishida, Masahiro Yasuda, Shoichiro Saito |
| 2020 | Interspeech | Listen to What You Want: Neural Network-Based Universal Sound Selector. | Tsubasa Ochiai, Marc Delcroix, Yuma Koizumi, Hiroaki Ito, Keisuke Kinoshita, Shoko Araki |
| 2020 | Interspeech | Crossmodal Sound Retrieval Based on Specific Target Co-Occurrence Denoted with Weak Labels. | Masahiro Yasuda, Yasunori Ohishi, Yuma Koizumi, Noboru Harada |
| 2019 | ICASSP | A Two-class Hyper-spherical Autoencoder for Supervised Anomaly Detection. | Yuta Kawachi, Yuma Koizumi, Shin Murata, Noboru Harada |
| 2019 | ICASSP | Trainable Adaptive Window Switching for Speech Enhancement. | Yuma Koizumi, Noboru Harada, Yoichi Haneda |
| 2019 | ICASSP | SNIPER: Few-shot Learning for Anomaly Detection to Minimize False-negative Rate with Ensured True-positive Rate. | Yuma Koizumi, Shin Murata, Noboru Harada, Shoichiro Saito, Hisashi Uematsu |
| 2019 | ICASSP | Deep Griffin-Lim Iteration. | Yoshiki Masuyama, Kohei Yatabe, Yuma Koizumi, Yasuhiro Oikawa, Noboru Harada |
| 2019 | ICASSP | Data-driven Design of Perfect Reconstruction Filterbank for DNN-based Sound Source Enhancement. | Daiki Takeuchi, Kohei Yatabe, Yuma Koizumi, Yasuhiro Oikawa, Noboru Harada |
| 2019 | ICASSP | AdaFlow: Domain-adaptive Density Estimator with Application to Anomaly Detection and Unpaired Cross-domain Translation. | Masataka Yamaguchi, Yuma Koizumi, Noboru Harada |
| 2018 | ICASSP | Complementary Set Variational Autoencoder for Supervised Anomaly Detection. | Yuta Kawachi, Yuma Koizumi, Noboru Harada |
| 2018 | ICASSP | End-to-End Sound Source Enhancement Using Deep Neural Network in the Modified Discrete Cosine Transform Domain. | Yuma Koizumi, Noboru Harada, Yoichi Haneda, Yusuke Hioka, Kazunori Kobayashi |
| 2017 | ICASSP | DNN-based source enhancement self-optimized by reinforcement learning using sound quality measurements. | Yuma Koizumi, Kenta Niwa, Yusuke Hioka, Kazunori Kobayashi, Yoichi Haneda |
| 2017 | ICASSP | Supervised source enhancement composed of nonnegative auto-encoders and complementarity subtraction. | Kenta Niwa, Yuma Koizumi, Tomoko Kawase, Kazunori Kobayashi, Yusuke Hioka |
| 2017 | ICASSP | On relationships between amplitude and phase of short-time Fourier transform. | Suehiro Shimauchi, Shinya Kudo, Yuma Koizumi, Ken'ichi Furuya |
| 2016 | ICASSP | Integrated approach of feature extraction and sound source enhancement based on maximization of mutual information. | Yuma Koizumi, Kenta Niwa, Yusuke Hioka, Kazunori Kobayashi, Hitoshi Ohmuro |
| 2016 | ICASSP | Pinpoint extraction of distant sound source based on DNN mapping from multiple beamforming outputs to prior SNR. | Kenta Niwa, Yuma Koizumi, Tomoko Kawase, Kazunori Kobayashi, Yusuke Hioka |
| 2016 | ICASSP | Binaural sound generation corresponding to omnidirectional video view using angular region-wise source enhancement. | Kenta Niwa, Yuma Koizumi, Kazunori Kobayashi, Hisashi Uematsu |
| 2014 | ICASSP | Intra-note segmentation via sticky HMM with DP emission. | Yuma Koizumi, Katunobu Itou |