| 2013 | Interspeech | Musical noise analysis for Bayesian minimum mean-square error speech amplitude estimators based on higher-order statistics. | Hiroshi Saruwatari, Suzumi Kanehara, Ryoichi Miyazaki, Kiyohiro Shikano, Kazunobu Kondo |
| 2012 | ICASSP | Musical-noise-free speech enhancement: Theory and evaluation. | Ryoichi Miyazaki, Hiroshi Saruwatari, Takayuki Inoue, Kiyohiro Shikano, Kazunobu Kondo |
| 2012 | ICASSP | Speech kurtosis estimation from observed noisy signal based on generalized Gaussian distribution prior and additivity of cumulants. | Ryo Wakisaka, Hiroshi Saruwatari, Kiyohiro Shikano, Tomoya Takatani |
| 2012 | ICASSP | Statistical approach to voice quality control in esophageal speech enhancement. | Kenzo Yamamoto, Tomoki Toda, Hironori Doi, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2012 | Interspeech | Evaluation of Many-to-Many Alignment Algorithm by Automatic Pronunciation Annotation Using Web Text Mining. | Keigo Kubo, Hiromichi Kawanami, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2012 | Interspeech | Spoken Inquiry Discrimination Using Bag-of-Words for Speech-Oriented Guidance System. | Haruka Majima, Rafael Torres, Yoko Fujita, Hiromichi Kawanami, Tomoko Matsui, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2011 | ICASSP | Acoustic model training for non-audible murmur recognition using transformed normal speech data. | Denis Babani, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2011 | ICASSP | An evaluation of alaryngeal speech enhancement methods based on voice conversion techniques. | Hironori Doi, Keigo Nakamura, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2011 | ICASSP | Theoretical analysis of musical noise in Wiener filtering family via higher-order statistics. | Takayuki Inoue, Hiroshi Saruwatari, Kiyohiro Shikano, Kazunobu Kondo |
| 2011 | ICASSP | Robust sound field reproduction integrating multi-point sound field control and wave field synthesis. | Noriyoshi Kamado, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2011 | ICASSP | Automatic musical thumbnailing based on audio object localization and its evaluation. | Hiroyuki Nawata, Noriyoshi Kamado, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2011 | Interspeech | Speaker-Adaptive Speech Synthesis Based on Eigenvoice Conversion and Language-Dependent Prosodic Conversion in Speech-to-Speech Translation. | Nobuhiko Hattori, Tomoki Toda, Hisashi Kawai, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2011 | Interspeech | Theoretical Analysis of Musical Noise and Speech Distortion in Structure-Generalized Parametric Blind Spatial Subtraction Array. | Ryoichi Miyazaki, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2011 | Interspeech | Blind Speech Prior Estimation for Generalized Minimum Mean-Square Error Short-Time Spectral Amplitude Estimator. | Ryo Wakisaka, Hiroshi Saruwatari, Kiyohiro Shikano, Tomoya Takatani |
| 2010 | ICASSP | Statistical approach to enhancing esophageal speech based on Gaussian mixture models. | Hironori Doi, Keigo Nakamura, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2010 | ICASSP | Complex Newton algorithm for blind signal extraction of speech in diffuse noise. | Jani Even, Hiroshi Saruwatari, Kiyohiro Shikano, Tomoya Takatani |
| 2010 | ICASSP | Speech enhancement in presence of diffuse background noise: Why using blind signal extraction? | Jani Even, Hiroshi Saruwatari, Kiyohiro Shikano, Tomoya Takatani |
| 2010 | ICASSP | Non-parallel training for many-to-many eigenvoice conversion. | Yamato Ohtani, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2010 | ICASSP | MMSE STSA estimator with nonstationary noise estimation based on ICA for high-quality speech enhancement. | Ryoi Okamoto, Yu Takahashi, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2010 | Interspeech | The use of air-pressure sensor in electrolaryngeal speech enhancement based on statistical voice conversion. | Keigo Nakamura, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2010 | Interspeech | Adaptive voice-quality control based on one-to-many eigenvoice conversion. | Kumi Ohta, Tomoki Toda, Yamato Ohtani, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2010 | Interspeech | Comparison of methods for topic classification in a speech-oriented guidance system. | Rafael Torres, Shota Takeuchi, Hiromichi Kawanami, Tomoko Matsui, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2010 | IROS | Improvement of speech recognition performance for spoken-oriented robot dialog system using end-fire array. | Hiroshi Sawada, Jani Even, Hiroshi Saruwatari, Kiyohiro Shikano, Tomoya Takatani |
| 2009 | ICASSP | Multiple ICA-based real-time blind source extraction applied to handy size microphone. | Takashi Hiekata, Takashi Morita, Youhei Ikeda, Hiroshi Hashimoto, Ruoyu Zhang, Yu Takahashi, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2009 | ICASSP | Kernel-based nonlinear independent component analysis for underdetermined blind source separation. | Shigeki Miyabe, Biing-Hwang Juang, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2009 | ICASSP | Acoustic compensation methods for body transmitted speech conversion. | Daisuke Miyamoto, Keigo Nakamura, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2009 | ICASSP | Hands-free speech recognition challenge for real-world speech dialogue systems. | Hiroshi Saruwatari, Hiromichi Kawanami, Shota Takeuchi, Yu Takahashi, Tobias Cincarek, Kiyohiro Shikano |
| 2009 | ICASSP | Source adaptive blind signal extraction using closed-form ICA for hands-free robot spoken dialogue system. | Yu Takahashi, Hiroshi Saruwatari, Yuki Fujihara, Kentaro Tachibana, Yoshimitsu Mori, Shigeki Miyabe, Kiyohiro Shikano, Akira Tanaka |
| 2009 | ICASSP | Musical noise analysis based on higher order statistics for microphone array and nonlinear signal processing. | Yu Takahashi, Yoshihisa Uemura, Hiroshi Saruwatari, Kiyohiro Shikano, Kazunobu Kondo |
| 2009 | ICASSP | Voice conversion for various types of body transmitted speech. | Tomoki Toda, Keigo Nakamura, Hidehiko Sekimoto, Kiyohiro Shikano |
| 2009 | ICASSP | Musical noise generation analysis for noise reduction methods based on spectral subtraction and MMSE STSA estimation. | Yoshihisa Uemura, Yu Takahashi, Hiroshi Saruwatari, Kiyohiro Shikano, Kazunobu Kondo |
| 2009 | Interspeech | Electrolaryngeal speech enhancement based on statistical voice conversion. | Keigo Nakamura, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2009 | Interspeech | Many-to-many eigenvoice conversion with reference voice. | Yamato Ohtani, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2009 | Interspeech | Technologies for processing body-conducted speech detected with non-audible murmur microphone. | Tomoki Toda, Keigo Nakamura, Takayuki Nagai, Tomomi Kaino, Yoshitaka Nakajima, Kiyohiro Shikano |
| 2009 | IROS | Semi-blind suppression of internal noise for hands-free robot spoken dialog system. | Jani Even, Hiroshi Sawada, Hiroshi Saruwatari, Kiyohiro Shikano, Tomoya Takatani |
| 2009 | IDA | Target Speech Enhancement in Presence of Jammer and Diffuse Background Noise. | Jani Even, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2008 | ICASSP | Frequency domain semi-blind signal separation: application to the rejection of internal noises. | Jani Even, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2008 | ICASSP | Distant talking robust speech recognition using late reflection components of room impulse response. | Randy Gomez, Jani Even, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2008 | ICASSP | Source-oriented localization control of stereo audio signals based on blind source separation. | Yuuki Haraguchi, Shigeki Miyabe, Hiroshi Saruwatari, Kiyohiro Shikano, Toshiyuki Nomura |
| 2008 | ICASSP | Hybrid structure of inverse filtering and DOA-parameterized wavefront synthesis. | Yuuta Yuyama, Shigeki Miyabe, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2008 | Interspeech | Rapid unsupervised speaker adaptation robust in reverberant environment conditions. | Randy Gomez, Jani Even, Kiyohiro Shikano |
| 2008 | Interspeech | Low-delay voice conversion based on maximum likelihood estimation of spectral parameter trajectory. | Takashi Muramatsu, Yamato Ohtani, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2008 | Interspeech | Evaluation of speaking-aid system with voice conversion for laryngectomees toward its use in practical environments. | Keigo Nakamura, Tomoki Toda, Yoshitaka Nakajima, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2008 | Interspeech | An improved one-to-many eigenvoice conversion system. | Yamato Ohtani, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2008 | Interspeech | Speaker verification with non-audible murmur segments by combining global alignment kernel and penalized logistic regression machine. | Hideki Okamoto, Tomoko Matsui, Hiromichi Kawanami, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2008 | Interspeech | Development and evaluation of hands-free spoken dialogue system for railway station guidance. | Hiroshi Saruwatari, Yu Takahashi, Hiroyuki Sakai, Shota Takeuchi, Tobias Cincarek, Hiromichi Kawanami, Kiyohiro Shikano |
| 2008 | Interspeech | Question and answer database optimization using speech recognition results. | Shota Takeuchi, Tobias Cincarek, Hiromichi Kawanami, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2008 | Interspeech | Maximum a posteriori adaptation for many-to-one eigenvoice conversion. | Daisuke Tani, Tomoki Toda, Yamato Ohtani, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2008 | IROS | An improved permutation solver for blind signal separation based front-ends in robot audition. | Jani Even, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2008 | IROS | Real-time implementation of blind spatial subtraction array for hands-free robot spoken dialogue system. | Yu Takahashi, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2007 | ASRU | Development and portability of ASR and Q&A modules for real-environment speech-oriented guidance systems. | Tobias Cincarek, Hiromichi Kawanami, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2007 | ICASSP | Insights Gained from Development and Long-Term Operation of a Real-Environment Speech-Oriented Guidance System. | Tobias Cincarek, Ryuichi Nisimura, Akinobu Lee, Kiyohiro Shikano |
| 2007 | ICASSP | High-Presence Hearing-Aid System using DSP-Based Real-Time Blind Source Separation Module. | Yoshimitsu Mori, Tomoya Takatani, Hiroshi Saruwatari, Kiyohiro Shikano, Takashi Hiekata, Takashi Morita |
| 2007 | ICASSP | Efficient Blind Source Separation Combining Closed-Form Second-Order ICA and Nonclosed-Form Higher-Order ICA. | Kentaro Tachibana, Hiroshi Saruwatari, Yoshimitsu Mori, Shigeki Miyabe, Kiyohiro Shikano, Akira Tanaka |
| 2007 | ICASSP | Permutation-Robust Structure for ICA-Based Blind Source Extraction. | Yu Takahashi, Tomoya Takatani, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2007 | ICASSP | One-to-Many and Many-to-One Voice Conversion Based on Eigenvoices. | Tomoki Toda, Yamato Ohtani, Kiyohiro Shikano |
| 2007 | Interspeech | Development of preschool children subsystem for ASR and q&a in a real-environment speech-oriented guidance task. | Tobias Cincarek, Izumi Shindo, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2007 | Interspeech | Rapid unsupervised speaker adaptation using single utterance based on MLLR and speaker selection. | Randy Gomez, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2007 | Interspeech | How to judge reusability of existing speech corpora for target task by utilizing statistical multidimensional scaling. | Goshu Nagino, Makoto Shozakai, Kiyohiro Shikano |
| 2007 | Interspeech | Impact of various small sound source signals on voice conversion accuracy in speech communication aid for laryngectomees. | Keigo Nakamura, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2007 | Interspeech | Speaker adaptive training for one-to-many eigenvoice conversion based on Gaussian mixture model. | Yamato Ohtani, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2007 | Interspeech | Study on speaker verification with non-audible murmur segments. | Hideki Okamoto, Mariko Kojima, Tomoko Matsui, Hiromichi Kawanami, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2007 | MMSP | Real-Time Continuous Speech Recognition System on SH-4A Microprocessor. | Hiroaki Kokubo, Nobuo Hataoka, Akinobu Lee, Tatsuya Kawahara, Kiyohiro Shikano |
| 2006 | ICASSP | Improving Rapid Unsupervised Speaker Adaptation Based On Hmm Sufficient Statistics. | Randy Gomez, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2006 | ICASSP | Double-Talk Free Spoken Dialogue Interface Combining Sound Field Control With Semi-Blind Source Separation. | Shigeki Miyabe, Tomoya Takatani, Yoshimitsu Mori, Hiroshi Saruwatari, Kiyohiro Shikano, Yosuke Tatekura |
| 2006 | Interspeech | Acoustic modeling for spoken dialogue systems based on unsupervised utterance-based selective training. | Tobias Cincarek, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2006 | Interspeech | Speaker verification with non-audible murmur segments. | Mariko Kojima, Tomoko Matsui, Hiromichi Kawanami, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2006 | Interspeech | Improving body transmitted unvoiced speech with statistical voice conversion. | Mikihiro Nakagiri, Tomoki Toda, Hideki Kashioka, Kiyohiro Shikano |
| 2006 | Interspeech | Speaking aid system for total laryngectomees using voice conversion of body transmitted artificial speech. | Keigo Nakamura, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2006 | Interspeech | Maximum likelihood voice conversion based on GMM with STRAIGHT mixed excitation. | Yamato Ohtani, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2006 | Interspeech | Eigenvoice conversion based on Gaussian mixture model. | Tomoki Toda, Yamato Ohtani, Kiyohiro Shikano |
| 2006 | LREC | Transcription Cost Reduction for Constructing Acoustic Models Using Acoustic Likelihood Selection Criteria. | Tomoyuki Kato, Tomiki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2006 | LREC | Long-term Analysis of Prosodic Features of Spoken Guidance System User Speech. | Hiromichi Kawanami, Takahiro Kitamura, Kiyohiro Shikano |
| 2006 | MMSP | Embedded Julius: Continuous Speech Recognition Software for Microprocessor. | Hiroaki Kokubo, Hiroaki Hataoka, Akinobu Lee, Tatsuya Kawahara, Kiyohiro Shikano |
| 2005 | ICDE | Speech Enhancement Based on Blind Source Separation in Car Environments. | Hiroshi Saruwatari, Katsuyuki Sawai, Tsuyoki Nishikawa, Akinobu Lee, Kiyohiro Shikano, Atsunobu Kaminuma, Masao Sakata, Daisuke Saitoh |
| 2005 | Interspeech | Rapid unsupervised speaker adaptation based on multi-template HMM sufficient statistics in noisy environments. | Randy Gomez, Akinobu Lee, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2005 | Interspeech | Investigating the role of the Lombard reflex in non-audible murmur (NAM) recognition. | Panikos Heracleous, Tomomi Kaino, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2005 | Interspeech | Applications of NAM microphones in speech recognition for privacy in human-machine communication. | Panikos Heracleous, Tomomi Kaino, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2005 | Interspeech | Remodeling of the sensor for non-audible murmur (NAM). | Yoshitaka Nakajima, Hideki Kashioka, Kiyohiro Shikano, Nick Campbell |
| 2005 | Interspeech | Operating a public spoken guidance system in real environment. | Ryuichi Nisimura, Akinobu Lee, Masashi Yamada, Kiyohiro Shikano |
| 2005 | Interspeech | NAM-to-speech conversion with Gaussian mixture models. | Tomoki Toda, Kiyohiro Shikano |
| 2005 | IROS | Noise-robust hands-free speech recognition based on spatial subtraction array and known noise superimposition. | Yasuaki Ohashi, Tsuyoki Nishikawa, Hiroshi Saruwatari, Akinobu Lee, Kiyohiro Shikano |
| 2005 | IROS | Two-stage blind source separation based on ICA and binary masking for real-time robot audition system. | Hiroshi Saruwatari, Yoshimitsu Mori, Tomoya Takatani, Satoshi Ukai, Kiyohiro Shikano, Takashi Hiekata, Takashi Morita |
| 2005 | IROS | Blind sound scene decomposition for robot audition using SIMO-model-based ICA. | Tomoya Takatani, Satoshi Ukai, Tsuyoki Nishikawa, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2004 | ICASSP | Real-time word confidence scoring using local posterior probabilities on tree trellis search. | Akinobu Lee, Kiyohiro Shikano, Tatsuya Kawahara |
| 2004 | ICASSP | Overdetermined blind separation for convolutive mixtures of speech based on multistage ICA using subarray processing. | Tsuyoki Nishikawa, Hiroshi Abe, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2004 | ICASSP | Public speech-oriented guidance system with adult and child discrimination capability. | Ryuichi Nisimura, Akinobu Lee, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2004 | ICASSP | Blind separation of binaural sound mixtures using SIMO-model-based independent component analysis. | Tomoya Takatani, Tsuyoki Nishikawa, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2004 | Interspeech | Interface for barge-in free spoken dialogue system using adaptive sound field control. | Tatsunori Asai, Shigeki Miyabe, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2004 | Interspeech | Robust speech recognition with spectral subtraction in low SNR. | Randy Gomez, Akinobu Lee, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2004 | Interspeech | Non-audible murmur (NAM) speech recognition using a stethoscopic NAM microphone. | Panikos Heracleous, Yoshitaka Nakajima, Akinobu Lee, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2004 | Interspeech | Recent progress of open-source LVCSR engine julius and Japanese model repository. | Tatsuya Kawahara, Akinobu Lee, Kazuya Takeda, Katsunobu Itou, Kiyohiro Shikano |
| 2004 | Interspeech | Noise robust real world spoken dialogue system using GMM based rejection of unintended inputs. | Akinobu Lee, Keisuke Nakamura, Ryuichi Nisimura, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2004 | Interspeech | MAP estimation of speech spectral component under GGD a priori. | Rajkishore Prasad, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2004 | Interspeech | Rapid EM training based on model-integration. | Shinichi Yoshizawa, Kiyohiro Shikano |
| 2004 | LREC | Perceptual Evaluation of Quality Deterioration Owing to Prosody Modification. | Kazuki Adachi, Tomoki Toda, Hiromichi Kawanami, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2003 | ICASSP | Interface for barge-in free spoken dialogue system based on sound field control and microphone array. | Yoichi Hinamoto, Kouichi Mino, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2003 | ICASSP | Non-audible murmur recognition input interface using stethoscopic microphone attached to the skin. | Yoshitaka Nakajima, Hideki Kashioka, Kiyohiro Shikano, Nick Campbell |
| 2003 | ICASSP | Segment selection considering local degradation of naturalness in concatenative speech synthesis. | Tomoki Toda, Hisashi Kawai, Minoru Tsuzaki, Kiyohiro Shikano |
| 2003 | IJCNN | Parallel structured independent component analysis for SIMO-model-based blind separation and deconvolution of convolutive speech mixture. | Hiroshi Saruwatari, Hiroaki Yamajo, Tomoya Takatani, Tsuyoki Nishikawa, Kiyohiro Shikano |
| 2003 | Interspeech | A semi-blind source separation method for hands-free speech recognition of multiple talkers. | Panikos Heracleous, Satoshi Nakamura, Kiyohiro Shikano |
| 2003 | Interspeech | GMM-based voice conversion applied to emotional speech synthesis. | Hiromichi Kawanami, Yohei Iwami, Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2003 | Interspeech | Non-audible murmur recognition. | Yoshitaka Nakajima, Hideki Kashioka, Kiyohiro Shikano, Nick Campbell |
| 2003 | Interspeech | Environmental sound source identification based on hidden Markov model for robust speech recognition. | Takanobu Nishiura, Satoshi Nakamura, Kazuhiro Miki, Kiyohiro Shikano |
| 2003 | Interspeech | Simple designing methods of corpus-based visual speech synthesis. | Tatsuya Shiraishi, Tomoki Toda, Hiromichi Kawanami, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2003 | Interspeech | Unsupervised speaker adaptation based on HMM sufficient statistics in various noisy environments. | Shingo Yamade, Akinobu Lee, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2003 | Interspeech | Blind separation and deconvolution for convolutive mixture of speech using SIMO-model-based ICA and multichannel inverse filtering. | Hiroaki Yamajo, Hiroshi Saruwatari, Tomoya Takatani, Tsuyoki Nishikawa, Kiyohiro Shikano |
| 2003 | Interspeech | Model-integration rapid training based on maximum likelihood for speech recognition. | Shinichi Yoshizawa, Kiyohiro Shikano |
| 2002 | ICASSP | Bund source separation based on Multi-Stage ICA combining frequency-domain ICA and time-domain ICA. | Tsuyoki Nishikawa, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2002 | ICASSP | Talker localization in a real acoustic environment based on DOA estimation and statistical sound source identification. | Takanobu Nishiura, Satoshi Nakamura, Kiyohiro Shikano |
| 2002 | ICASSP | Unit selection algorithm for Japanese speech synthesis based on both phoneme unit and diphone unit. | Tomoki Toda, Hisashi Kawai, Minoru Tsuzaki, Kiyohiro Shikano |
| 2002 | Interspeech | Using start/end timings of spectral transitions between phonemes in concatenative speech synthesis. | Toshio Hirai, Seiichi Tenpaku, Kiyohiro Shikano |
| 2002 | Interspeech | Designing Japanese speech database covering wide range in prosody for hybrid speech synthesizer. | Hiromichi Kawanami, Tsuyoshi Masuda, Tomoki Toda, Kiyohiro Shikano |
| 2002 | Interspeech | Selective multi-path acoustic model based on database likelihoods. | Akinobu Lee, Yuichiro Mera, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2002 | Interspeech | Evaluation of cross-language voice conversion using bilingual and non-bilingual databases. | Mikiko Mashimo, Tomoki Toda, Hiromichi Kawanami, Hideki Kashioka, Kiyohiro Shikano, Nick Campbell |
| 2002 | Interspeech | Suitable design of adaptive beamformer based on average speech spectrum for noisy speech recognition. | Takanobu Nishiura, Satoshi Nakamura, Yuka Okada, Takeshi Yamada, Kiyohiro Shikano |
| 2002 | Interspeech | Speech enhancement in car environment using blind source separation. | Hiroshi Saruwatari, Katsuyuki Sawai, Akinobu Lee, Kiyohiro Shikano, Atsunobu Kaminuma, Masao Sakata |
| 2002 | Interspeech | Spectral subtraction in noisy environments applied to speaker adaptation based on HMM sufficient statistics. | Shingo Yamade, Kanako Matsunami, Akira Baba, Akinobu Lee, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2002 | IROS | ASKA: receptionist robot with speech dialogue system. | Ryuichi Nisimura, Takashi Uchida, Akinobu Lee, Hiroshi Saruwatari, Kiyohiro Shikano, Yoshio Matsumoto |
| 2002 | LREC | Designing speech database with prosodic variety for expressive TTS system. | Hiromichi Kawanami, Tsuyoshi Masuda, Tomoki Toda, Kiyohiro Shikano |
| 2002 | LREC | Continuous Speech Recognition Consortium an Open Repository for CSR Tools and Models. | Akinobu Lee, Tatsuya Kawahara, Kazuya Takeda, Masato Mimura, Atsushi Yamada, Akinori Ito, Katsunobu Itou, Kiyohiro Shikano |
| 2001 | ICASSP | A microphone array-based 3-D N-best search algorithm for the simultaneous recognition of multiple sound sources in real environments. | Panikos Heracleous, Satoshi Nakamura, Kiyohiro Shikano |
| 2001 | ICASSP | Gaussian mixture selection using context-independent HMM. | Akinobu Lee, Tatsuya Kawahara, Kiyohiro Shikano |
| 2001 | ICASSP | Speech enhancement by multiple beamforming with reflection signal equalization. | Takanobu Nishiura, S. Nakanura, Kiyohiro Shikano |
| 2001 | ICASSP | Voice conversion algorithm based on Gaussian mixture model with dynamic frequency warping of STRAIGHT spectrum. | Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2001 | ICASSP | Unsupervised speaker adaptation based on sufficient HMM statistics of selected speakers. | Shinichi Yoshizawa, Akira Baba, Kanako Matsunami, Yuichiro Mera, Miichi Yamada, Kiyohiro Shikano |
| 2001 | Interspeech | Elderly acoustic model for large vocabulary continuous speech recognition. | Akira Baba, Shinichi Yoshizawa, Miichi Yamada, Akinobu Lee, Kiyohiro Shikano |
| 2001 | Interspeech | Julius - an open source real-time large vocabulary recognition engine. | Akinobu Lee, Tatsuya Kawahara, Kiyohiro Shikano |
| 2001 | Interspeech | Evaluation of cross-language voice conversion based on GMM and straight. | Mikiko Mashimo, Tomoki Toda, Kiyohiro Shikano, Nick Campbell |
| 2001 | Interspeech | Statistical sound source identification in a real acoustic environment for robust speech recognition using a microphone array. | Takanobu Nishiura, Satoshi Nakamura, Kiyohiro Shikano |
| 2001 | Interspeech | Automatic n-gram language model creation from web resources. | Ryuichi Nisimura, Kumiko Komatsu, Yuka Kuroda, Kentaro Nagatomo, Akinobu Lee, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2001 | Interspeech | Blind source separation for speech based on fast-convergence algorithm with ICA and beamforming. | Hiroshi Saruwatari, Toshiya Kawamura, Kiyohiro Shikano |
| 2001 | Interspeech | High quality voice conversion based on Gaussian mixture model with dynamic frequency warping. | Tomoki Toda, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2001 | Interspeech | Unsupervised noisy environment adaptation algorithm using MLLR and speaker selection. | Miichi Yamada, Akira Baba, Shinichi Yoshizawa, Yuichiro Mera, Akinobu Lee, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2001 | Interspeech | Evaluation on unsupervised speaker adaptation based on sufficient HMM statictics of selected speakers. | Shinichi Yoshizawa, Akira Baba, Kanako Matsunami, Yuichiro Mera, Miichi Yamada, Akinobu Lee, Kiyohiro Shikano |
| 2000 | ICASSP | A new phonetic tied-mixture model for efficient decoding. | Akinobu Lee, Tatsuya Kawahara, Kazuya Takeda, Kiyohiro Shikano |
| 2000 | ICASSP | Localization of multiple sound sources based on a CSP analysis with a microphone array. | Takanobu Nishiura, Takeshi Yamada, Satoshi Nakamura, Kiyohiro Shikano |
| 2000 | ICASSP | Speech recognition for a distant moving speaker based on HMM composition and separation. | Tetsuya Takiguchi, Satoshi Nakamura, Kiyohiro Shikano |
| 2000 | Interspeech | Robust fundamental frequency estimation using instantaneous frequencies of harmonic components. | Yoshinori Atake, Toshio Irino, Hideki Kawahara, Jinlin Lu, Satoshi Nakamura, Kiyohiro Shikano |
| 2000 | Interspeech | Manipulating speech pitch periods according to optimal insertion/deletion position in residual signal for intonation control in speech synthesis. | Toshio Hirai, Seiichi Tenpaku, Kiyohiro Shikano |
| 2000 | Interspeech | Free software toolkit for Japanese large vocabulary continuous speech recognition. | Tatsuya Kawahara, Akinobu Lee, Tetsunori Kobayashi, Kazuya Takeda, Nobuaki Minematsu, Shigeki Sagayama, Katsunobu Itou, Akinori Ito, Mikio Yamamoto, Atsushi Yamada, Takehito Utsuro, Kiyohiro Shikano |
| 2000 | Interspeech | Stream weight optimization of speech and lip image sequence for audio-visual speech recognition. | Satoshi Nakamura, Hidetoshi Ito, Kiyohiro Shikano |
| 2000 | Interspeech | Blind source separation based on subband ICA and beamforming. | Hiroshi Saruwatari, Satoshi Kurita, Kazuya Takeda, Fumitada Itakura, Kiyohiro Shikano |
| 2000 | Interspeech | Straight-based voice conversion algorithm based on Gaussian mixture model. | Tomoki Toda, Jinlin Lu, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2000 | Interspeech | Investigation of analysis and synthesis parameters of straight by subjective evaluation. | Parham Zolfaghari, Yoshinori Atake, Kiyohiro Shikano, Hideki Kawahara |
| 2000 | LREC | IPA Japanese Dictation Free Software Project. | Katsunobu Itou, Kiyohiro Shikano, Tatsuya Kawahara, Kazuya Takeda, Atsushi Yamada, Akinori Ito, Takehito Utsuro, Tetsunori Kobayashi, Nobuaki Minematsu, Mikio Yamamoto, Shigeki Sagayama, Akinobu Lee |
| 1999 | Interspeech | Simultaneous recognition of multiple sound sources based on 3-d n-best search using microphone array. | Panikos Heracleous, Takeshi Yamada, Satoshi Nakamura, Kiyohiro Shikano |
| 1998 | ICASSP | Efficient representation of short-time phase based on group delay. | Hideki Banno, Jinlin Lu, Satoshi Nakamura, Kiyohiro Shikano, Hideki Kawahara |
| 1998 | ICASSP | Robust speech recognition in car environments. | Makoto Shozakai, Satoshi Nakamura, Kiyohiro Shikano |
| 1998 | ICASSP | Hands-free speech recognition based on 3-D Viterbi search using a microphone array. | Takeshi Yamada, Satoshi Nakamura, Kiyohiro Shikano |
| 1998 | Interspeech | Creating speaker independent HMM models for restricted database using STRAIGHT-TEMPO morphing. | Alexandre Girardi, Kiyohiro Shikano, Satoshi Nakamura |
| 1998 | Interspeech | The design of the newspaper-based Japanese large vocabulary continuous speech recognition corpus. | Katunobu Itou, Mikio Yamamoto, Kazuya Takeda, Toshiyuki Takezawa, Tatsuo Matsuoka, Tetsunori Kobayashi, Kiyohiro Shikano, Shuichi Itahashi |
| 1998 | Interspeech | Sharable software repository for Japanese large vocabulary continuous speech recognition. | Tatsuya Kawahara, Tetsunori Kobayashi, Kazuya Takeda, Nobuaki Minematsu, Katsunobu Itou, Mikio Yamamoto, Atsushi Yamada, Takehito Utsuro, Kiyohiro Shikano |
| 1998 | Interspeech | Evaluation of model adaptation by HMM decomposition on telephone speech recognition. | Tetsuya Takiguchi, Satoshi Nakamura, Kiyohiro Shikano, Masatoshi Morishima, Toshihiro Isobe |
| 1998 | Interspeech | An effect of adaptive beamforming on hands-free speech recognition based on 3-d viterbi search. | Takeshi Yamada, Satoshi Nakamura, Kiyohiro Shikano |
| 1998 | Interspeech | Speech-to-lip movement synthesis based on the EM algorithm using audio-visual HMMs. | Eli Yamamoto, Satoshi Nakamura, Kiyohiro Shikano |
| 1998 | Interspeech | Compression algorithm of trigram language models based on maximum likelihood estimation. | Norimichi Yodo, Kiyohiro Shikano, Satoshi Nakamura |
| 1998 | MMSP | Speech-to-lip movement synthesis maximizing audio-visual joint probability based on EM algorithm. | Satoshi Nakamura, Eli Yamamoto, Kiyohiro Shikano |
| 1997 | ICASSP | Model adaptation based on HMM decomposition for reverberant speech recognition. | Tetsuya Takiguchi, Satoshi Nakamura, Qiang Hou, Kiyohiro Shikano |
| 1997 | Interspeech | Maximum likelihood successive state splitting algorithm for tied-mixture HMNET. | Alexandre Girardi, Harald Singer, Kiyohiro Shikano, Satoshi Nakamura |
| 1997 | Interspeech | Microphone array design measures for hands-free speech recognition. | Masaaki Inoue, Satoshi Nakamura, Takeshi Yamada, Kiyohiro Shikano |
| 1997 | Interspeech | Improved bimodal speech recognition using tied-mixture HMMs and 5000 word audio-visual synchronous database. | Satoshi Nakamura, Ron Nagai, Kiyohiro Shikano |
| 1997 | Interspeech | Room acoustics and reverberation: impact on hands-free recognition. | Satoshi Nakamura, Kiyohiro Shikano |
| 1997 | Interspeech | A non-iterative model-adaptive e-CMN/PMC approach for speech recognition in car environments. | Makoto Shozakai, Satoshi Nakamura, Kiyohiro Shikano |
| 1996 | ICASSP | Noise and room acoustics distorted speech recognition by HMM composition. | Satoshi Nakamura, Tetsuya Takiguchi, Kiyohiro Shikano |
| 1996 | Interspeech | Robust speech recognition with speaker localization by a microphone array. | Takeshi Yamada, Satoshi Nakamura, Kiyohiro Shikano |
| 1996 | Interspeech | Entropy coded vector quantization with hidden Markov models. | Tadashi Yonezaki, Kiyohiro Shikano |
| 1994 | ICASSP | Search algorithm that merges candidates in meaning level for very large vocabulary spontaneous speech recognition. | Yasuhiro Minami, Kiyohiro Shikano, Satoshi Takahashi, Tomokazu Yamada |
| 1994 | Interspeech | An HMM duration control algorithm with a low computational cost. | Satoshi Takahashi, Yasuhiro Minami, Kiyohiro Shikano |
| 1994 | Interspeech | A multi-modal dialogue system for telephone directory assistance. | Osamu Yoshioka, Yasuhiro Minami, Kiyohiro Shikano |
| 1994 | NAACL | A Large-Vocabulary Continuous Speech Recognition Algorithm and its Application to a Multi-Modal Telephone Directory Assistance System. | Yasuhiro Minami, Kiyohiro Shikano, Osamu Yoshioka, Satoshi Takahashi, Tomokazu Yamada, Sadaoki Furui |
| 1993 | ICASSP | Phoneme HMMs constrained by frame correlations. | Satoshi Takahashi, Tatsuo Matsuoka, Yasuhiro Minami, Kiyohiro Shikano |
| 1993 | Interspeech | Recognition of noisy speech by composition of hidden Markov models. | Franck Martin, Kiyohiro Shikano, Yasuhiro Minami |
| 1993 | Interspeech | Dictation system using inductively auto-generated syntax. | Shoichi Matsunaga, Tomokazu Yamada, Kiyohiro Shikano |
| 1993 | Interspeech | Very-large-vocabulary continuous speech recognition algorithm for telephone directory assistance. | Yasuhiro Minami, Kiyohiro Shikano, Tomokazu Yamada, Tatsuo Matsuoka |
| 1992 | ICASSP | Task adaptation in stochastic language models for continuous speech recognition. | Shoichi Matsunaga, Tomokazu Yamada, Kiyohiro Shikano |
| 1992 | ICASSP | Phonemic HMM constrained by statistical VQ-code transition. | Satoshi Takahashi, Tatsuo Matsuoka, Kiyohiro Shikano |
| 1992 | ICASSP | Japanese dictation system using character source modeling. | Tomokazu Yamada, Shoichi Matsunaga, Kiyohiro Shikano |
| 1992 | Interspeech | Continuous speech recognition for medical diagnoses using a character trigram model. | Shoichi Matsunaga, Toshiaki Tsuboi, Tomokazu Yamada, Kiyohiro Shikano |
| 1992 | Interspeech | Speaker adaptation by modifying mixture coefficients of speaker-independent mixture Gaussian HMMs. | Tatsuo Matsuoka, Kiyohiro Shikano |
| 1992 | Interspeech | Phoneme HMM evaluation algorithm without phoneme labeling. | Yasuhiro Minami, Tatsuo Matsuoka, Kiyohiro Shikano |
| 1992 | Interspeech | Hardware implementation of realtime 1000-word HMM-LR continuous speech recognition. | Akito Nagai, Kenji Kita, Toshiyuki Hanazawa, Tadashi Suzuki, Tomohiro Iwasaki, Tsuyoshi Kawabata, Kunio Nakajima, Kiyohiro Shikano, Tsuyoshi Morimoto, Shigeki Sagayama, Akira Kurematsu |
| 1992 | NAACL | Recent Topics in Speech Recognition Research at NTT Laboratories. | Sadaoki Furui, Kiyohiro Shikano, Shoichi Matsunaga, Tatsuo Matsuoka, Satoshi Takahashi, Tomokazu Yamada |
| 1991 | ICASSP | Robust HMM phoneme modeling for different speaking styles. | Tatsuo Matsuoka, Kiyohiro Shikano |
| 1991 | ICASSP | Phonetic typewriter based on phoneme source modeling. | Tomokazu Yamada, Toshiyuki Hanazawa, Takeshi Kawabata, Shoichi Matsunaga, Kiyohiro Shikano |
| 1990 | COLING | Neural Network Approach To Word Category Prediction For English Texts. | Masami Nakamura, Katsuteru Maruyama, Takeshi Kawabata, Kiyohiro Shikano |
| 1990 | ICASSP | Cross-language voice conversion. | Masanobu Abe, Kiyohiro Shikano, Hisao Kuwabara |
| 1990 | ICASSP | ATR HMM-LR continuous speech recognition system. | Toshiyuki Hanazawa, Kenji Kita, Satoshi Nakamura, Takeshi Kawabata, Kiyohiro Shikano |
| 1990 | ICASSP | Supplementation of HMM for articulatory variation in speaker adaptation. | Hiroaki Hattori, Satoshi Nakamura, Kiyohiro Shikano |
| 1990 | ICASSP | Integrated training for spotting Japanese phonemes using large phonemic time-delay neural networks. | Masanori Miyatake, Hidefumi Sawai, Yasuhiro Minami, Kiyohiro Shikano |
| 1990 | ICASSP | A comparative study of spectral mapping for speaker adaptation. | Satoshi Nakamura, Kiyohiro Shikano |
| 1990 | Interspeech | Speaker weighted training of HMM using multiple reference speakers. | Hiroaki Hattori, Satoshi Nakamura, Kiyohiro Shikano, Shigeki Sagayama |
| 1990 | Interspeech | Japanese phonetic typewriter using HMM phone units and syllable trigrams. | Takeshi Kawabata, Toshiyuki Hanazawa, Katsunobu Itou, Kiyohiro Shikano |
| 1990 | Interspeech | On the robustness of HMM and ANN speech recognition algorithms. | Yasuhiro Minami, Toshiyuki Hanazawa, Hitoshi Iwamida, Erik McDermott, Kiyohiro Shikano, Shigeru Katagiri, Masaona Kagawa |
| 1990 | Interspeech | Integration of speech recognition and language processing in spoken language translation system (SL-TRANS). | Tsuyoshi Morimoto, Kiyohiro Shikano, Hitoshi Iida, Akira Kurematsu |
| 1989 | ICASSP | Phoneme segmentation using spectrogram reading knowledge. | Kaichiro Hatazaki, Yasuhiro Komori, Takeshi Kawabata, Kiyohiro Shikano |
| 1989 | ICASSP | Island-driven continuous speech recognizer using phone-based HMM word spotting. | Takeshi Kawabata, Kiyohiro Shikano |
| 1989 | ICASSP | Speaker adaptation applied to HMM and neural networks. | Satoshi Nakamura, Kiyohiro Shikano |
| 1989 | ICASSP | A study of English word category prediction based on neutral networks. | Masami Nakamura, Kiyohiro Shikano |
| 1989 | ICASSP | Spotting Japanese CV-syllables and phonemes using time-delay neural networks. | Hidefumi Sawai, Alex Waibel, Masanori Miyatake, Kiyohiro Shikano |
| 1989 | ICASSP | Consonant recognition by modular construction of large phonemic time-delay neural networks. | Alex Waibel, Hidefumi Sawai, Kiyohiro Shikano |
| 1989 | Interspeech | Fast back-propagation learning methods for large phonemic neural networks. | Patrick Haffner, Alex Waibel, Hidefumi Sawai, Kiyohiro Shikano |
| 1989 | Interspeech | Phoneme recognition expert system using spectrogram reading knowledge and neural networks. | Yasuhiro Komori, Kaichiro Hatazaki, Takaharu Tanaka, Takeshi Kawabata, Kiyohiro Shikano |
| 1988 | ICASSP | Voice conversion through vector quantization. | Masanobu Abe, Satoshi Nakamura, Kiyohiro Shikano, Hisao Kuwabara |
| 1988 | ICASSP | Phoneme recognition: neural networks vs. hidden Markov models. | Alex Waibel, Toshiyuki Hanazawa, Geoffrey E. Hinton, Kiyohiro Shikano, Kevin J. Lang |
| 1987 | ICASSP | Improvement of word recognition results by trigram model. | Kiyohiro Shikano |
| 1986 | ICASSP | Speaker adaptation through vector quantization. | Kiyohiro Shikano, Kai-Fu Lee, Raj Reddy |
| 1985 | ICASSP | Spoken word recognition based on top-down phoneme segmentation. | Kiyoaki Aikawa, Masahide Sugiyama, Kiyohiro Shikano |
| 1983 | ICASSP | Isolated word recognition using phoneme-like templates. | Noboru Sugamura, Kiyohiro Shikano, Sadaoki Furui |
| 1981 | ICASSP | Acoustic processing in the conversational speech recognition system. | Kiyohiro Shikano |
| 1976 | ICASSP | Speech recognition in the question-answering system operated by conversational speech. | Masaki Kohda, Ryohei Nakatsu, Kiyohiro Shikano |