| 2021 | Interspeech | Noise Robust Acoustic Modeling for Single-Channel Speech Recognition Based on a Stream-Wise Transformer Architecture. | Masakiyo Fujimoto, Hisashi Kawai |
| 2019 | Interspeech | One-Pass Single-Channel Noisy Speech Recognition Using a Combination of Noisy and Enhanced Features. | Masakiyo Fujimoto, Hisashi Kawai |
| 2018 | ICASSP | Comparative Evaluations of Various Factored Deep Convolutional Rnn Architectures for Noise Robust Speech Recognition. | Masakiyo Fujimoto, Hisashi Kawai |
| 2017 | Interspeech | Factored Deep Convolutional Neural Networks for Noise Robust Speech Recognition. | Masakiyo Fujimoto |
| 2016 | ICASSP | Multi-pass feature enhancement based on generative-discriminative hybrid approach for noise robust speech recognition. | Masakiyo Fujimoto, Tomohiro Nakatani |
| 2016 | ICASSP | Real-time integration of statistical model-based speech enhancement with unsupervised noise PSD estimation using microphone array. | Tomoko Kawase, Kenta Niwa, Masakiyo Fujimoto, Noriyoshi Kamado, Kazunori Kobayashi, Shoko Araki, Tomohiro Nakatani |
| 2016 | ICASSP | A generative-discriminative hybrid approach to multi-channel noise reduction for robust automatic speech recognition. | Hendrik Meutzner, Shoko Araki, Masakiyo Fujimoto, Tomohiro Nakatani |
| 2015 | ASRU | The NTT CHiME-3 system: Advances in speech enhancement and recognition for mobile multi-microphone devices. | Takuya Yoshioka, Nobutaka Ito, Marc Delcroix, Atsunori Ogawa, Keisuke Kinoshita, Masakiyo Fujimoto, Chengzhu Yu, Wojciech J. Fabian, Miquel Espi, Takuya Higuchi, Shoko Araki, Tomohiro Nakatani |
| 2015 | ICASSP | Exploring multi-channel features for denoising-autoencoder-based speech enhancement. | Shoko Araki, Tomoki Hayashi, Marc Delcroix, Masakiyo Fujimoto, Kazuya Takeda, Tomohiro Nakatani |
| 2015 | ICASSP | Feature enhancement based on generative-discriminative hybrid approach with gmms and DNNS for noise robust speech recognition. | Masakiyo Fujimoto, Tomohiro Nakatani |
| 2015 | Interspeech | Feature extraction strategies in deep learning based acoustic event detection. | Miquel Espi, Masakiyo Fujimoto, Keisuke Kinoshita, Tomohiro Nakatani |
| 2014 | ICASSP | Unsupervised non-parametric Bayesian modeling of non-stationary noise for model-based noise suppression. | Masakiyo Fujimoto, Yotaro Kubo, Tomohiro Nakatani |
| 2013 | ICASSP | Feature space variational Bayesian linear regression and its combination with model space VBLR. | Seong-Jun Hahm, Atsunori Ogawa, Marc Delcroix, Masakiyo Fujimoto, Takaaki Hori, Atsushi Nakamura |
| 2013 | Interspeech | Model-based noise suppression using unsupervised estimation of hidden Markov model for non-stationary noise. | Masakiyo Fujimoto, Tomohiro Nakatani |
| 2012 | ICASSP | A tandem connectionist model using combination of multi-scale spectro-temporal features for acoustic event detection. | Miquel Espi, Masakiyo Fujimoto, Daisuke Saito, Nobutaka Ono, Shigeki Sagayama |
| 2012 | ICASSP | Noise suppression with unsupervised joint speaker adaptation and noise mixture model estimation. | Masakiyo Fujimoto, Shinji Watanabe, Tomohiro Nakatani |
| 2012 | ICASSP | LogMax observation model with MFCC-based spectral prior for reduction of highly nonstationary ambient noise. | Tomohiro Nakatani, Takuya Yoshioka, Shoko Araki, Marc Delcroix, Masakiyo Fujimoto |
| 2012 | Interspeech | Speaker Adaptation Using Variational Bayesian Linear Regression in Normalized Feature Space. | Seong-Jun Hahm, Atsunori Ogawa, Masakiyo Fujimoto, Takaaki Hori, Atsushi Nakamura |
| 2011 | ICASSP | Non-stationary noise estimation method based on bias-residual component decomposition for robust speech recognition. | Masakiyo Fujimoto, Shinji Watanabe, Tomohiro Nakatani |
| 2011 | ICASSP | Joint unsupervised learning of hidden Markov source models and source location models for multichannel source separation. | Tomohiro Nakatani, Shoko Araki, Takuya Yoshioka, Masakiyo Fujimoto |
| 2011 | Interspeech | A Robust Estimation Method of Noise Mixture Model for Noise Suppression. | Masakiyo Fujimoto, Shinji Watanabe, Tomohiro Nakatani |
| 2011 | Interspeech | Reduction of Highly Nonstationary Ambient Noise by Integrating Spectral and Locational Characteristics of Speech and Noise for Robust ASR. | Tomohiro Nakatani, Shoko Araki, Marc Delcroix, Takuya Yoshioka, Masakiyo Fujimoto |
| 2010 | Interspeech | Voice activity detection using frame-wise model re-estimation method based on Gaussian pruning with weight normalization. | Masakiyo Fujimoto, Shinji Watanabe, Tomohiro Nakatani |
| 2010 | Interspeech | Multichannel source separation based on source location cue with log-spectral shaping by hidden Markov source model. | Tomohiro Nakatani, Shoko Araki, Takuya Yoshioka, Masakiyo Fujimoto |
| 2009 | ICMI | A speaker diarization method based on the probabilistic fusion of audio-visual location information. | Kentaro Ishizuka, Shoko Araki, Kazuhiro Otsuka, Tomohiro Nakatani, Masakiyo Fujimoto |
| 2009 | ICMI | Realtime meeting analysis and 3D meeting viewer based on omnidirectional multimodal sensors. | Kazuhiro Otsuka, Shoko Araki, Dan Mikami, Kentaro Ishizuka, Masakiyo Fujimoto, Junji Yamato |
| 2009 | Interspeech | A study of mutual front-end processing method based on statistical model for noise robust speech recognition. | Masakiyo Fujimoto, Kentaro Ishizuka, Tomohiro Nakatani |
| 2008 | ICASSP | Speaker indexing and speech enhancement in real meetings / conversations. | Shoko Araki, Masakiyo Fujimoto, Kentaro Ishizuka, Hiroshi Sawada, Shoji Makino |
| 2008 | ICASSP | A voice activity detection based on the adaptive integration of multiple speech features and a signal decision scheme. | Masakiyo Fujimoto, Kentaro Ishizuka, Tomohiro Nakatani |
| 2008 | ICMI | A realtime multimodal system for analyzing group meetings by combining face pose tracking and speaker diarization. | Kazuhiro Otsuka, Shoko Araki, Kentaro Ishizuka, Masakiyo Fujimoto, Martin Heinrich, Junji Yamato |
| 2008 | Interspeech | Study of integration of statistical model-based voice activity detection and noise suppression. | Masakiyo Fujimoto, Kentaro Ishizuka, Tomohiro Nakatani |
| 2008 | Interspeech | CENSREC-4: development of evaluation framework for distant-talking speech recognition under reverberant environments. | Masato Nakayama, Takanobu Nishiura, Yuki Denda, Norihide Kitaoka, Kazumasa Yamamoto, Takeshi Yamada, Satoru Tsuge, Chiyomi Miyajima, Masakiyo Fujimoto, Tetsuya Takiguchi, Satoshi Tamura, Tetsuji Ogawa, Shigeki Matsuda, Shingo Kuroiwa, Kazuya Takeda, Satoshi Nakamura |
| 2008 | LREC | Evaluation Framework for Distant-talking Speech Recognition under Reverberant Environments: newest Part of the CENSREC Series -. | Takanobu Nishiura, Masato Nakayama, Yuki Denda, Norihide Kitaoka, Kazumasa Yamamoto, Takeshi Yamada, Satoru Tsuge, Chiyomi Miyajima, Masakiyo Fujimoto, Tetsuya Takiguchi, Satoshi Tamura, Shingo Kuroiwa, Kazuya Takeda, Satoshi Nakamura |
| 2007 | ASRU | Development of VAD evaluation framework CENSREC-1-C and investigation of relationship between VAD and speech recognition performance. | Norihide Kitaoka, Kazumasa Yamamoto, Tomohiro Kusamizu, Seiichi Nakagawa, Takeshi Yamada, Satoru Tsuge, Chiyomi Miyajima, Takanobu Nishiura, Masato Nakayama, Yuki Denda, Masakiyo Fujimoto, Tetsuya Takiguchi, Satoshi Tamura, Shingo Kuroiwa, Kazuya Takeda, Satoshi Nakamura |
| 2007 | ICASSP | Noise Robust Voice Activity Detection Based on Statistical Model and Parallel Non-Linear Kalman Filtering. | Masakiyo Fujimoto, Kentaro Ishizuka, Hiroko Kato Solvang |
| 2007 | ICASSP | Two-Microphone Voice Activity Detection Based on the Homogeneity of the Direction of Arrival Estimates. | Juan E. Rubio, Kentaro Ishizuka, Hiroshi Sawada, Shoko Araki, Tomohiro Nakatani, Masakiyo Fujimoto |
| 2007 | Interspeech | Noise robust voice activity detection based on switching kalman filter. | Masakiyo Fujimoto, Kentaro Ishizuka |
| 2007 | Interspeech | Noise robust front-end processing with voice activity detection based on periodic to aperiodic component ratio. | Kentaro Ishizuka, Tomohiro Nakatani, Masakiyo Fujimoto, Noboru Miyazaki |
| 2006 | ICASSP | Sequential Non-Stationary Noise Tracking Using Particle Filtering with Switching Dynamical System. | Masakiyo Fujimoto, Satoshi Nakamura |
| 2006 | Interspeech | CENSREC2: corpus and evaluation environments for in car continuous digit speech recognition. | Satoshi Nakamura, Masakiyo Fujimoto, Kazuya Takeda |
| 2005 | ICASSP | Particle Filter Based Non-Stationary Noise Tracking for Robust Speech Recognition. | Masakiyo Fujimoto, Satoshi Nakamura |
| 2005 | ICDE | CENSREC-3: Data Collection for In-Car Speech Recognition and Its Common Evaluation Framework. | Masakiyo Fujimoto, Satoshi Nakamura, Toshiki Endo, Kazuya Takeda, Chiyomi Miyajima, Shingo Kuroiwa, Takeshi Yamada, Norihide Kitaoka, Kazumasa Yamamoto, Mitsunori Mizumachi, Takanobu Nishiura, Akira Sasou |
| 2004 | ICASSP | Robust speech recognition in additive and channel noise environments using GMM and EM algorithm. | Masakiyo Fujimoto, Yasuo Ariki |
| 2003 | Interspeech | Live speech recognition in sports games by adaptation of acoustic model and language model. | Yasuo Ariki, Takeru Shigemori, Tsuyoshi Kaneko, Jun Ogata, Masakiyo Fujimoto |
| 2003 | Interspeech | Combination of temporal domain SVD based speech enhancement and GMM based speech estimation for ASR in noise - evaluation on the AURORA2 task -. | Masakiyo Fujimoto, Yasuo Ariki |
| 2003 | Interspeech | Integration of noise reduction algorithms for Aurora2 task. | Takeshi Yamada, Jiro Okada, Kazuya Takeda, Norihide Kitaoka, Masakiyo Fujimoto, Shingo Kuroiwa, Kazumasa Yamamoto, Takanobu Nishiura, Mitsunori Mizumachi, Satoshi Nakamura |
| 2002 | Interspeech | Evaluation of noisy speech recognition based on noise reduction and acoustic model adaptation on the Aurora2 tasks. | Masakiyo Fujimoto, Yasuo Ariki |
| 2001 | ICASSP | Continuous speech recognition under non-stationary musical environments based on speech state transition model. | Masakiyo Fujimoto, Yasuo Ariki |
| 2001 | Interspeech | Speech recognition under musical environments using kalman filter and iterative MLLR adaptation. | Masakiyo Fujimoto, Yasuo Ariki |
| 2000 | ICASSP | Noisy speech recognition using noise reduction method based on Kalman filter. | Masakiyo Fujimoto, Yasuo Ariki |