| 2025 | Interspeech | Multi-lingual and Zero-Shot Speech Recognition by Incorporating Classification of Language-Independent Articulatory Features. | Ryo Magoshi, Shinsuke Sakai, Jaeyoung Lee, Tatsuya Kawahara |
| 2024 | Interspeech | Efficient and Robust Long-Form Speech Recognition with Hybrid H3-Conformer. | Tomoki Honda, Shinsuke Sakai, Tatsuya Kawahara |
| 2022 | Interspeech | Non-autoregressive Error Correction for CTC-based ASR with Phone-conditioned Masked LM. | Hayato Futami, Hirofumi Inaguma, Sei Ueno, Masato Mimura, Shinsuke Sakai, Tatsuya Kawahara |
| 2021 | ASRU | ASR Rescoring and Confidence Estimation with Electra. | Hayato Futami, Hirofumi Inaguma, Masato Mimura, Shinsuke Sakai, Tatsuya Kawahara |
| 2021 | ASRU | Data Augmentation for ASR Using TTS Via a Discrete Representation. | Sei Ueno, Masato Mimura, Shinsuke Sakai, Tatsuya Kawahara |
| 2020 | Interspeech | Distilling the Knowledge of BERT for Sequence-to-Sequence ASR. | Hayato Futami, Hirofumi Inaguma, Sei Ueno, Masato Mimura, Shinsuke Sakai, Tatsuya Kawahara |
| 2020 | Interspeech | Generative Adversarial Training Data Adaptation for Very Low-Resource Automatic Speech Recognition. | Kohei Matsuura, Masato Mimura, Shinsuke Sakai, Tatsuya Kawahara |
| 2020 | LREC | Speech Corpus of Ainu Folklore and End-to-end Speech Recognition for Ainu Language. | Kohei Matsuura, Sei Ueno, Masato Mimura, Shinsuke Sakai, Tatsuya Kawahara |
| 2019 | ICASSP | Multi-speaker Sequence-to-sequence Speech Synthesis for Data Augmentation in Acoustic-to-word Speech Recognition. | Sei Ueno, Masato Mimura, Shinsuke Sakai, Tatsuya Kawahara |
| 2018 | Interspeech | Forward-Backward Attention Decoder. | Masato Mimura, Shinsuke Sakai, Tatsuya Kawahara |
| 2018 | Interspeech | Encoder Transfer for Attention-based Acoustic-to-word Speech Recognition. | Sei Ueno, Takafumi Moriya, Masato Mimura, Shinsuke Sakai, Yusuke Shinohara, Yoshikazu Yamaguchi, Yushi Aono, Tatsuya Kawahara |
| 2017 | ASRU | Cross-domain speech recognition using nonparallel corpora with cycle-consistent adversarial networks. | Masato Mimura, Shinsuke Sakai, Tatsuya Kawahara |
| 2017 | ICASSP | Semi-supervised ensemble DNN acoustic model training. | Sheng Li, Xugang Lu, Shinsuke Sakai, Masato Mimura, Tatsuya Kawahara |
| 2017 | Interspeech | Combined Multi-Channel NMF-Based Robust Beamforming for Noisy Speech Recognition. | Masato Mimura, Yoshiaki Bando, Kazuki Shimada, Shinsuke Sakai, Kazuyoshi Yoshii, Tatsuya Kawahara |
| 2016 | Interspeech | Joint Optimization of Denoising Autoencoder and DNN Acoustic Model Based on Multi-Target Learning for Noisy Speech Recognition. | Masato Mimura, Shinsuke Sakai, Tatsuya Kawahara |
| 2015 | ICASSP | Deep autoencoders augmented with phone-class feature for reverberant speech recognition. | Masato Mimura, Shinsuke Sakai, Tatsuya Kawahara |
| 2015 | Interspeech | Speech dereverberation using long short-term memory. | Masato Mimura, Shinsuke Sakai, Tatsuya Kawahara |
| 2011 | ICASSP | A sampling-based environment population projection approach for rapid acoustic model adaptation. | Yu Tsao, Shigeki Matsuda, Shinsuke Sakai, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura |
| 2010 | Interspeech | Improved training of excitation for HMM-based parametric speech synthesis. | Yoshinori Shiga, Tomoki Toda, Shinsuke Sakai, Hisashi Kawai |
| 2009 | ICASSP | CART-based modeling of Chinese tonal patterns with a functional model tracing the fundamental frequency trajectories. | Jinfu Ni, Shinsuke Sakai, Tohru Shimizu, Satoshi Nakamura |
| 2009 | ICASSP | Optimal learning of P-Layer additive F0 models with cross-validation. | Shinsuke Sakai, Tatsuya Kawahara, Tohru Shimizu, Satoshi Nakamura |
| 2009 | Interspeech | A decision tree-based clustering approach to state definition in an excitation modeling framework for HMM-based speech synthesis. | Ranniery Maia, Tomoki Toda, Keiichi Tokuda, Shinsuke Sakai, Satoshi Nakamura |
| 2009 | Interspeech | A close look into the probabilistic concatenation model for corpus-based speech synthesis. | Shinsuke Sakai, Ranniery Maia, Hisashi Kawai, Satoshi Nakamura |
| 2008 | IJCNLP | Development of Indonesian Large Vocabulary Continuous Speech Recognition System within A-STAR Project. | Sakriani Sakti, Eka Kelana, Hammam Riza, Shinsuke Sakai, Konstantin Markov, Satoshi Nakamura |
| 2006 | Interspeech | Decision tree-based training of probabilistic concatenation models for corpus-based speech synthesis. | Shinsuke Sakai, Tatsuya Kawahara |
| 2005 | ICASSP | Additive Modeling of English F0 Contour for Speech Synthesis. | Shinsuke Sakai |
| 2005 | Interspeech | A probabilistic approach to unit selection for corpus-based speech synthesis. | Shinsuke Sakai, Han Shu |
| 2000 | Interspeech | Continuous speech recognition with parse filtering. | Ken Hanazawa, Shinsuke Sakai |
| 2000 | Interspeech | An automatic interpretation system for travel conversation. | Takao Watanabe, Akitoshi Okumura, Shinsuke Sakai, Kiyoshi Yamabana, Shinichi Doi, Ken Hanazawa |
| 1994 | Interspeech | An automatic voice dialing system developed on PC speech i/o platform. | Jun Noguchi, Shinsuke Sakai, Kaichiro Hatazaki, Ken-ichi Iso, Takao Watanabe |
| 1993 | Interspeech | A bilingual Voyager system. | James R. Glass, David Goodine, Michael S. Phillips, Shinsuke Sakai, Stephanie Seneff, Victor W. Zue |
| 1993 | Interspeech | J-SUMMIT: Japanese spontaneous speech recognition. | Shinsuke Sakai, Michael S. Phillips |
| 1993 | NAACL | A Bilingual VOYAGER System. | David Goodine, Michael S. Phillips, Shinsuke Sakai, Stephanie Seneff, Victor Zue |
| 1992 | Interspeech | J-SUMMIT: a Japanese segment-based speech recognition system. | Shinsuke Sakai, Michael S. Phillips |
| 1990 | ICASSP | From interlingua to speech: generating prosodic information from conceptual representation. | Shinsuke Sakai, Kazunori Muraki |