| 2025 | ASSETS | Speaker-dependent Continuous Speech Recognition for Individuals with Cerebral Palsy Using Weighted Finite-State Transducer and Text-to-Speech Synthesis. | Takeru Otani, Ryo Aihara, Ryoichi Takashima, Tetsuya Takiguchi, Tatsuhiko Saito |
| 2025 | Interspeech | Factorized RVQ-GAN For Disentangled Speech Tokenization. | Sameer Khurana, Dominik Klement, Antoine Laurent, Dominik Bobos, Juraj Novosad, Peter Gazdik, Ellen Zhang, Zili Huang, Amir Hussein, Ricard Marxer, Yoshiki Masuyama, Ryo Aihara, Chiori Hori, Franois G. Germain, Gordon Wichern, Jonathan Le Roux |
| 2025 | Interspeech | Investigating continuous autoregressive generative speech enhancement. | Haici Yang, Gordon Wichern, Ryo Aihara, Yoshiki Masuyama, Sameer Khurana, Franois G. Germain, Jonathan Le Roux |
| 2024 | ASSETS | Self-supervised learning using unlabeled speech with multiple types of speech disorder for disordered speech recognition. | Ryoichi Takashima, Takeru Otani, Ryo Aihara, Tetsuya Takiguchi, Shinya Taguchi |
| 2022 | ICASSP | Speaker-Targeted Audio-Visual Speech Recognition Using a Hybrid CTC/Attention Model with Interference Loss. | Ryota Tsunoda, Ryo Aihara, Ryoichi Takashima, Tetsuya Takiguchi, Yoshie Imai |
| 2019 | ICASSP | Teacher-student Deep Clustering for Low-delay Single Channel Speech Separation. | Ryo Aihara, Toshiyuki Hanazawa, Yohei Okato, Gordon Wichern, Jonathan Le Roux |
| 2018 | CISIS | Reducing Computational Complexity of Multichannel Nonnegative Matrix Factorization Using Initial Value Setting for Speech Recognition. | Taiki Izumi, Ryo Aihara, Toshiyuki Hanazawa, Yohei Okato, Takanobu Uramoto, Shingo Uenohara, Ken'ichi Furuya |
| 2017 | Interspeech | Phoneme-Discriminative Features for Dysarthric Speech Conversion. | Ryo Aihara, Tetsuya Takiguchi, Yasuo Ariki |
| 2017 | MVA | Visual-to-speech conversion based on maximum likelihood estimation. | Rina Ra, Ryo Aihara, Tetsuya Takiguchi, Yasuo Ariki |
| 2016 | ICASSP | Semi-non-negative matrix factorization using alternating direction method of multipliers for voice conversion. | Ryo Aihara, Tetsuya Takiguchi, Yasuo Ariki |
| 2016 | Interspeech | Parallel Dictionary Learning for Voice Conversion Using Discriminative Graph-Embedded Non-Negative Matrix Factorization. | Ryo Aihara, Tetsuya Takiguchi, Yasuo Ariki |
| 2016 | Interspeech | Audio-Visual Speech Recognition Using Bimodal-Trained Bottleneck Features for a Person with Severe Hearing Loss. | Yuki Takashima, Ryo Aihara, Tetsuya Takiguchi, Yasuo Ariki, Nobuyuki Mitani, Kiyohiro Omori, Kaoru Nakazono |
| 2015 | ICASSP | Activity-mapping non-negative matrix factorization for exemplar-based voice conversion. | Ryo Aihara, Tetsuya Takiguchi, Yasuo Ariki |
| 2015 | Interspeech | Many-to-many voice conversion based on multiple non-negative matrix factorization. | Ryo Aihara, Tetsuya Takiguchi, Yasuo Ariki |
| 2014 | ICASSP | Voice conversion based on Non-negative matrix factorization using phoneme-categorized dictionary. | Ryo Aihara, Toru Nakashika, Tetsuya Takiguchi, Yasuo Ariki |
| 2014 | ICASSP | Multimodal voice conversion using non-negative matrix factorization in noisy environments. | Kenta Masaka, Ryo Aihara, Tetsuya Takiguchi, Yasuo Ariki |
| 2014 | Interspeech | Error correction of automatic speech recognition based on normalized web distance. | E. Byambakhishig, Katsuyuki Tanaka, Ryo Aihara, Toru Nakashika, Tetsuya Takiguchi, Yasuo Ariki |
| 2014 | Interspeech | Multimodal exemplar-based voice conversion using lip features in noisy environments. | Kenta Masaka, Ryo Aihara, Tetsuya Takiguchi, Yasuo Ariki |
| 2013 | ICASSP | Individuality-preserving voice conversion for articulation disorders based on non-negative matrix factorization. | Ryo Aihara, Ryoichi Takashima, Tetsuya Takiguchi, Yasuo Ariki |
| 2013 | Interspeech | Exemplar-based individuality-preserving voice conversion for articulation disorders in noisy environments. | Ryo Aihara, Ryoichi Takashima, Tetsuya Takiguchi, Yasuo Ariki |