Skip to content

Ken'ichi Kumatani

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

27

Venues

6

Active years

2002–2025

Best venue rank

A*

Where they publish

Papers

27 indexed papers, newest first.

YearVenueTitleAuthors
2025ASRUTowards Efficient Speech-Text Jointly Decoding within One Speech Language Model.Haibin Wu, Yuxuan Hu, Ruchao Fan, Xiaofei Wang, Ken'ichi Kumatani, Bo Ren, Jianwei Yu, Heng Lu, Lijuan Wang, Yao Qian, Jinyu Li
2021ICASSPEnsemble Combination between Different Time Segmentations.Jeremy Heng Meng Wong, Dimitrios Dimitriadis, Ken'ichi Kumatani, Yashesh Gaur, George Polovets, Partha Parthasarathy, Eric Sun, Jinyu Li, Yifan Gong
2021ICMLUniSpeech: Unified Speech Representation Learning with Labeled and Unlabeled Data.Chengyi Wang, Yu Wu, Yao Qian, Ken'ichi Kumatani, Shujie Liu, Furu Wei, Michael Zeng, Xuedong Huang
2021InterspeechOne-Shot Voice Conversion with Speaker-Agnostic StarGAN.Sefik Emre Eskimez, Dimitrios Dimitriadis, Ken'ichi Kumatani, Robert Gmyr
2020ICASSPRobust Multi-Channel Speech Recognition Using Frequency Aligned Network.Taejin Park, Ken'ichi Kumatani, Minhua Wu, Shiva Sundaram
2020ICASSPFully Learnable Front-End for Multi-Channel Acoustic Modeling Using Semi-Supervised Learning.Sanna Wager, Aparna Khare, Minhua Wu, Ken'ichi Kumatani, Shiva Sundaram
2020InterspeechA Federated Approach in Training Acoustic Models.Dimitrios Dimitriadis, Ken'ichi Kumatani, Robert Gmyr, Yashesh Gaur, Sefik Emre Eskimez
2020InterspeechSequence-Level Self-Learning with Multiple Hypotheses.Ken'ichi Kumatani, Dimitrios Dimitriadis, Yashesh Gaur, Robert Gmyr, Sefik Emre Eskimez, Jinyu Li, Michael Zeng
2019ICASSPMulti-geometry Spatial Acoustic Modeling for Distant Speech Recognition.Ken'ichi Kumatani, Minhua Wu, Shiva Sundaram, Nikko Strm, Bjrn Hoffmeister
2019ICASSPImproving Noise Robustness of Automatic Speech Recognition via Parallel Data and Teacher-student Learning.Ladislav Mosner, Minhua Wu, Anirudh Raju, Sree Hari Krishnan Parthasarathi, Ken'ichi Kumatani, Shiva Sundaram, Roland Maas, Bjrn Hoffmeister
2019ICASSPFrequency Domain Multi-channel Acoustic Modeling for Distant Speech Recognition.Minhua Wu, Ken'ichi Kumatani, Shiva Sundaram, Nikko Strm, Bjrn Hoffmeister
2018ICASSPTime-Delayed Bottleneck Highway Networks Using a DFT Feature for Keyword Spotting.Jinxi Guo, Ken'ichi Kumatani, Ming Sun, Minhua Wu, Anirudh Raju, Nikko Strom, Arindam Mandal
2017ASRUDirect modeling of raw audio with DNNS for wake word detection.Ken'ichi Kumatani, Sankaran Panchapagesan, Minhua Wu, Minjae Kim, Nikko Strom, Gautam Tiwari, Arindam Mandal
2015ICASSPFree energy for speech recognition.Rita Singh, Ken'ichi Kumatani
2013ICASSPJoint constrained maximum likelihood regression for overlapping speech recognition.Ken'ichi Kumatani, Rita Singh, Friedrich Faubel, John W. McDonough, Youssef Oualil
2013ICASSPSpeaker tracking with spherical microphone arrays.John W. McDonough, Ken'ichi Kumatani, Takayuki Arakawa, Kazumasa Yamamoto, Bhiksha Raj
2012InterspeechMicrophone Array Post-filter based on Spatially-Correlated Noise Measurements for Distant Speech Recognition.Ken'ichi Kumatani, Bhiksha Raj, Rita Singh, John W. McDonough
2012InterspeechA signal-separation-based array postfilter for distant speech recognition.Rita Singh, Ken'ichi Kumatani, John W. McDonough, Chen Liu
2011ACSSCAn information filter for voice prompt suppression.John W. McDonough, Wei Chu, Ken'ichi Kumatani, Bhiksha Raj, Jill Fain Lehman
2011ASRUMaximum kurtosis beamforming with a subspace filter for distant speech recognition.Ken'ichi Kumatani, John W. McDonough, Bhiksha Raj
2008ICASSPFilter bank design based on minimization of individual aliasing terms for minimum mutual information subband adaptive beamforming.Ken'ichi Kumatani, John W. McDonough, S. Schachl, Dietrich Klakow, Philip N. Garner, Weifeng Li
2008InterspeechMaximum kurtosis beamforming with the generalized sidelobe canceller.Ken'ichi Kumatani, John W. McDonough, Barbara Rauch, Philip N. Garner, Weifeng Li, John Dines
2007ASRUMinimum mutual information beamforming for simultaneous active speakers.Ken'ichi Kumatani, Uwe Mayer, Tobias Gehrig, Emilian Stoimenov, John W. McDonough, Matthias Wlfel
2007ICASSPState Synchronous Modeling on Phone Boundary for Audio Visual Speech Recognition and Application to Muti-View Face Images.Ken'ichi Kumatani, Rainer Stiefelhagen
2006InterspeechAdvances in lecture recognition: the ISL RT-06s evaluation system.Christian Fgen, Matthias Wlfel, John W. McDonough, Shajith Ikbal, Florian Kraft, Kornel Laskowski, Mari Ostendorf, Sebastian Stker, Ken'ichi Kumatani
2002ICASSPRobust bi-modal speech recognition based on state synchronous modeling and stream weight optimization.Satoshi Nakamura, Ken'ichi Kumatani, Satoshi Tamura
2002ICMIMulti-Modal Temporal Asynchronicity Modeling by Product HMMs for Robust.Satoshi Nakamura, Ken'ichi Kumatani, Satoshi Tamura