| 2022 | ICASSP | Phone-Informed Refinement of Synthesized Mel Spectrogram for Data Augmentation in Speech Recognition. | Sei Ueno, Tatsuya Kawahara |
| 2022 | Interspeech | Non-autoregressive Error Correction for CTC-based ASR with Phone-conditioned Masked LM. | Hayato Futami, Hirofumi Inaguma, Sei Ueno, Masato Mimura, Shinsuke Sakai, Tatsuya Kawahara |
| 2021 | ASRU | Data Augmentation for ASR Using TTS Via a Discrete Representation. | Sei Ueno, Masato Mimura, Shinsuke Sakai, Tatsuya Kawahara |
| 2020 | Interspeech | End-to-End Speech-to-Dialog-Act Recognition. | Viet-Trung Dang, Tianyu Zhao, Sei Ueno, Hirofumi Inaguma, Tatsuya Kawahara |
| 2020 | Interspeech | End-to-End Speech Emotion Recognition Combined with Acoustic-to-Word ASR Model. | Han Feng, Sei Ueno, Tatsuya Kawahara |
| 2020 | Interspeech | Distilling the Knowledge of BERT for Sequence-to-Sequence ASR. | Hayato Futami, Hirofumi Inaguma, Sei Ueno, Masato Mimura, Shinsuke Sakai, Tatsuya Kawahara |
| 2020 | LREC | Speech Corpus of Ainu Folklore and End-to-end Speech Recognition for Ainu Language. | Kohei Matsuura, Sei Ueno, Masato Mimura, Shinsuke Sakai, Tatsuya Kawahara |
| 2019 | ICASSP | Multi-speaker Sequence-to-sequence Speech Synthesis for Data Augmentation in Acoustic-to-word Speech Recognition. | Sei Ueno, Masato Mimura, Shinsuke Sakai, Tatsuya Kawahara |
| 2018 | ICASSP | Acoustic-to-Word Attention-Based Model Complemented with Character-Level CTC-Based Model. | Sei Ueno, Hirofumi Inaguma, Masato Mimura, Tatsuya Kawahara |
| 2018 | Interspeech | Multi-task Learning with Augmentation Strategy for Acoustic-to-word Attention-based Encoder-decoder Speech Recognition. | Takafumi Moriya, Sei Ueno, Yusuke Shinohara, Marc Delcroix, Yoshikazu Yamaguchi, Yushi Aono |
| 2018 | Interspeech | Encoder Transfer for Attention-based Acoustic-to-word Speech Recognition. | Sei Ueno, Takafumi Moriya, Masato Mimura, Shinsuke Sakai, Yusuke Shinohara, Yoshikazu Yamaguchi, Yushi Aono, Tatsuya Kawahara |