Skip to content

Yuma Koizumi

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

30

Venues

2

Active years

2014–2024

Best venue rank

Multiconference

Where they publish

Papers

30 indexed papers, newest first.

YearVenueTitleAuthors
2024InterspeechFLEURS-R: A Restored Multilingual Speech Corpus for Generation Tasks.Min Ma, Yuma Koizumi, Shigeki Karita, Heiga Zen, Jason Riesa, Haruko Ishikawa, Michiel Bacchiani
2023InterspeechLibriTTS-R: A Restored Multi-Speaker Text-to-Speech Corpus.Yuma Koizumi, Heiga Zen, Shigeki Karita, Yifan Ding, Kohei Yatabe, Nobuyuki Morioka, Michiel Bacchiani, Yu Zhang, Wei Han, Ankur Bapna
2022InterspeechSNRi Target Training for Joint Speech Enhancement and Recognition.Yuma Koizumi, Shigeki Karita, Arun Narayanan, Sankaran Panchapagesan, Michiel Bacchiani
2022InterspeechSpecGrad: Diffusion Probabilistic Model based Neural Vocoder with Adaptive Noise Spectral Shaping.Yuma Koizumi, Heiga Zen, Kohei Yatabe, Nanxin Chen, Michiel Bacchiani
2020ICASSPSound Event Detection by Multitask Learning of Sound Events and Scenes with Soft Scene Labels.Keisuke Imoto, Noriyuki Tonami, Yuma Koizumi, Masahiro Yasuda, Ryosuke Yamanishi, Yoichi Yamashita
2020ICASSPStable Training of Dnn for Speech Enhancement Based on Perceptually-Motivated Black-Box Cost Function.Masaki Kawanaka, Yuma Koizumi, Ryoichi Miyazaki, Kohei Yatabe
2020ICASSPSpeech Enhancement Using Self-Adaptation and Multi-Head Self-Attention.Yuma Koizumi, Kohei Yatabe, Marc Delcroix, Yoshiki Masuyama, Daiki Takeuchi
2020ICASSPSPIDERnet: Attention Network For One-Shot Anomaly Detection In Sounds.Yuma Koizumi, Masahiro Yasuda, Shin Murata, Shoichiro Saito, Hisashi Uematsu, Noboru Harada
2020ICASSPPhase Reconstruction Based On Recurrent Phase Unwrapping With Deep Neural Networks.Yoshiki Masuyama, Kohei Yatabe, Yuma Koizumi, Yasuhiro Oikawa, Noboru Harada
2020ICASSPReal-Time Speech Enhancement Using Equilibriated RNN.Daiki Takeuchi, Kohei Yatabe, Yuma Koizumi, Yasuhiro Oikawa, Noboru Harada
2020ICASSPInvertible DNN-Based Nonlinear Time-Frequency Transform for Speech Enhancement.Daiki Takeuchi, Kohei Yatabe, Yuma Koizumi, Yasuhiro Oikawa, Noboru Harada
2020ICASSPSound Event Localization Based on Sound Intensity Vector Refined by Dnn-Based Denoising and Source Separation.Masahiro Yasuda, Yuma Koizumi, Shoichiro Saito, Hisashi Uematsu, Keisuke Imoto
2020InterspeechA Transformer-Based Audio Captioning Model with Keyword Estimation.Yuma Koizumi, Ryo Masumura, Kyosuke Nishida, Masahiro Yasuda, Shoichiro Saito
2020InterspeechListen to What You Want: Neural Network-Based Universal Sound Selector.Tsubasa Ochiai, Marc Delcroix, Yuma Koizumi, Hiroaki Ito, Keisuke Kinoshita, Shoko Araki
2020InterspeechCrossmodal Sound Retrieval Based on Specific Target Co-Occurrence Denoted with Weak Labels.Masahiro Yasuda, Yasunori Ohishi, Yuma Koizumi, Noboru Harada
2019ICASSPA Two-class Hyper-spherical Autoencoder for Supervised Anomaly Detection.Yuta Kawachi, Yuma Koizumi, Shin Murata, Noboru Harada
2019ICASSPTrainable Adaptive Window Switching for Speech Enhancement.Yuma Koizumi, Noboru Harada, Yoichi Haneda
2019ICASSPSNIPER: Few-shot Learning for Anomaly Detection to Minimize False-negative Rate with Ensured True-positive Rate.Yuma Koizumi, Shin Murata, Noboru Harada, Shoichiro Saito, Hisashi Uematsu
2019ICASSPDeep Griffin-Lim Iteration.Yoshiki Masuyama, Kohei Yatabe, Yuma Koizumi, Yasuhiro Oikawa, Noboru Harada
2019ICASSPData-driven Design of Perfect Reconstruction Filterbank for DNN-based Sound Source Enhancement.Daiki Takeuchi, Kohei Yatabe, Yuma Koizumi, Yasuhiro Oikawa, Noboru Harada
2019ICASSPAdaFlow: Domain-adaptive Density Estimator with Application to Anomaly Detection and Unpaired Cross-domain Translation.Masataka Yamaguchi, Yuma Koizumi, Noboru Harada
2018ICASSPComplementary Set Variational Autoencoder for Supervised Anomaly Detection.Yuta Kawachi, Yuma Koizumi, Noboru Harada
2018ICASSPEnd-to-End Sound Source Enhancement Using Deep Neural Network in the Modified Discrete Cosine Transform Domain.Yuma Koizumi, Noboru Harada, Yoichi Haneda, Yusuke Hioka, Kazunori Kobayashi
2017ICASSPDNN-based source enhancement self-optimized by reinforcement learning using sound quality measurements.Yuma Koizumi, Kenta Niwa, Yusuke Hioka, Kazunori Kobayashi, Yoichi Haneda
2017ICASSPSupervised source enhancement composed of nonnegative auto-encoders and complementarity subtraction.Kenta Niwa, Yuma Koizumi, Tomoko Kawase, Kazunori Kobayashi, Yusuke Hioka
2017ICASSPOn relationships between amplitude and phase of short-time Fourier transform.Suehiro Shimauchi, Shinya Kudo, Yuma Koizumi, Ken'ichi Furuya
2016ICASSPIntegrated approach of feature extraction and sound source enhancement based on maximization of mutual information.Yuma Koizumi, Kenta Niwa, Yusuke Hioka, Kazunori Kobayashi, Hitoshi Ohmuro
2016ICASSPPinpoint extraction of distant sound source based on DNN mapping from multiple beamforming outputs to prior SNR.Kenta Niwa, Yuma Koizumi, Tomoko Kawase, Kazunori Kobayashi, Yusuke Hioka
2016ICASSPBinaural sound generation corresponding to omnidirectional video view using angular region-wise source enhancement.Kenta Niwa, Yuma Koizumi, Kazunori Kobayashi, Hisashi Uematsu
2014ICASSPIntra-note segmentation via sticky HMM with DP emission.Yuma Koizumi, Katunobu Itou