Ken'ichi Kumatani
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
27
Venues
6
Active years
2002–2025
Best venue rank
A*
Where they publish
Papers
27 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ASRU | Towards Efficient Speech-Text Jointly Decoding within One Speech Language Model. | Haibin Wu, Yuxuan Hu, Ruchao Fan, Xiaofei Wang, Ken'ichi Kumatani, Bo Ren, Jianwei Yu, Heng Lu, Lijuan Wang, Yao Qian, Jinyu Li |
| 2021 | ICASSP | Ensemble Combination between Different Time Segmentations. | Jeremy Heng Meng Wong, Dimitrios Dimitriadis, Ken'ichi Kumatani, Yashesh Gaur, George Polovets, Partha Parthasarathy, Eric Sun, Jinyu Li, Yifan Gong |
| 2021 | ICML | UniSpeech: Unified Speech Representation Learning with Labeled and Unlabeled Data. | Chengyi Wang, Yu Wu, Yao Qian, Ken'ichi Kumatani, Shujie Liu, Furu Wei, Michael Zeng, Xuedong Huang |
| 2021 | Interspeech | One-Shot Voice Conversion with Speaker-Agnostic StarGAN. | Sefik Emre Eskimez, Dimitrios Dimitriadis, Ken'ichi Kumatani, Robert Gmyr |
| 2020 | ICASSP | Robust Multi-Channel Speech Recognition Using Frequency Aligned Network. | Taejin Park, Ken'ichi Kumatani, Minhua Wu, Shiva Sundaram |
| 2020 | ICASSP | Fully Learnable Front-End for Multi-Channel Acoustic Modeling Using Semi-Supervised Learning. | Sanna Wager, Aparna Khare, Minhua Wu, Ken'ichi Kumatani, Shiva Sundaram |
| 2020 | Interspeech | A Federated Approach in Training Acoustic Models. | Dimitrios Dimitriadis, Ken'ichi Kumatani, Robert Gmyr, Yashesh Gaur, Sefik Emre Eskimez |
| 2020 | Interspeech | Sequence-Level Self-Learning with Multiple Hypotheses. | Ken'ichi Kumatani, Dimitrios Dimitriadis, Yashesh Gaur, Robert Gmyr, Sefik Emre Eskimez, Jinyu Li, Michael Zeng |
| 2019 | ICASSP | Multi-geometry Spatial Acoustic Modeling for Distant Speech Recognition. | Ken'ichi Kumatani, Minhua Wu, Shiva Sundaram, Nikko Strm, Bjrn Hoffmeister |
| 2019 | ICASSP | Improving Noise Robustness of Automatic Speech Recognition via Parallel Data and Teacher-student Learning. | Ladislav Mosner, Minhua Wu, Anirudh Raju, Sree Hari Krishnan Parthasarathi, Ken'ichi Kumatani, Shiva Sundaram, Roland Maas, Bjrn Hoffmeister |
| 2019 | ICASSP | Frequency Domain Multi-channel Acoustic Modeling for Distant Speech Recognition. | Minhua Wu, Ken'ichi Kumatani, Shiva Sundaram, Nikko Strm, Bjrn Hoffmeister |
| 2018 | ICASSP | Time-Delayed Bottleneck Highway Networks Using a DFT Feature for Keyword Spotting. | Jinxi Guo, Ken'ichi Kumatani, Ming Sun, Minhua Wu, Anirudh Raju, Nikko Strom, Arindam Mandal |
| 2017 | ASRU | Direct modeling of raw audio with DNNS for wake word detection. | Ken'ichi Kumatani, Sankaran Panchapagesan, Minhua Wu, Minjae Kim, Nikko Strom, Gautam Tiwari, Arindam Mandal |
| 2015 | ICASSP | Free energy for speech recognition. | Rita Singh, Ken'ichi Kumatani |
| 2013 | ICASSP | Joint constrained maximum likelihood regression for overlapping speech recognition. | Ken'ichi Kumatani, Rita Singh, Friedrich Faubel, John W. McDonough, Youssef Oualil |
| 2013 | ICASSP | Speaker tracking with spherical microphone arrays. | John W. McDonough, Ken'ichi Kumatani, Takayuki Arakawa, Kazumasa Yamamoto, Bhiksha Raj |
| 2012 | Interspeech | Microphone Array Post-filter based on Spatially-Correlated Noise Measurements for Distant Speech Recognition. | Ken'ichi Kumatani, Bhiksha Raj, Rita Singh, John W. McDonough |
| 2012 | Interspeech | A signal-separation-based array postfilter for distant speech recognition. | Rita Singh, Ken'ichi Kumatani, John W. McDonough, Chen Liu |
| 2011 | ACSSC | An information filter for voice prompt suppression. | John W. McDonough, Wei Chu, Ken'ichi Kumatani, Bhiksha Raj, Jill Fain Lehman |
| 2011 | ASRU | Maximum kurtosis beamforming with a subspace filter for distant speech recognition. | Ken'ichi Kumatani, John W. McDonough, Bhiksha Raj |
| 2008 | ICASSP | Filter bank design based on minimization of individual aliasing terms for minimum mutual information subband adaptive beamforming. | Ken'ichi Kumatani, John W. McDonough, S. Schachl, Dietrich Klakow, Philip N. Garner, Weifeng Li |
| 2008 | Interspeech | Maximum kurtosis beamforming with the generalized sidelobe canceller. | Ken'ichi Kumatani, John W. McDonough, Barbara Rauch, Philip N. Garner, Weifeng Li, John Dines |
| 2007 | ASRU | Minimum mutual information beamforming for simultaneous active speakers. | Ken'ichi Kumatani, Uwe Mayer, Tobias Gehrig, Emilian Stoimenov, John W. McDonough, Matthias Wlfel |
| 2007 | ICASSP | State Synchronous Modeling on Phone Boundary for Audio Visual Speech Recognition and Application to Muti-View Face Images. | Ken'ichi Kumatani, Rainer Stiefelhagen |
| 2006 | Interspeech | Advances in lecture recognition: the ISL RT-06s evaluation system. | Christian Fgen, Matthias Wlfel, John W. McDonough, Shajith Ikbal, Florian Kraft, Kornel Laskowski, Mari Ostendorf, Sebastian Stker, Ken'ichi Kumatani |
| 2002 | ICASSP | Robust bi-modal speech recognition based on state synchronous modeling and stream weight optimization. | Satoshi Nakamura, Ken'ichi Kumatani, Satoshi Tamura |
| 2002 | ICMI | Multi-Modal Temporal Asynchronicity Modeling by Product HMMs for Robust. | Satoshi Nakamura, Ken'ichi Kumatani, Satoshi Tamura |