| 2024 | ICASSP | Noise-Robust Zero-Shot Text-to-Speech Synthesis Conditioned on Self-Supervised Speech-Representation Model with Adapters. | Kenichi Fujita, Hiroshi Sato, Takanori Ashihara, Hiroki Kanagawa, Marc Delcroix, Takafumi Moriya, Yusuke Ijima |
| 2024 | Interspeech | Knowledge Distillation from Self-Supervised Representation Learning Model with Discrete Speech Units for Any-to-Any Streaming Voice Conversion. | Hiroki Kanagawa, Yusuke Ijima |
| 2024 | Interspeech | Pre-training Neural Transducer-based Streaming Voice Conversion for Faster Convergence and Alignment-free Training. | Hiroki Kanagawa, Takafumi Moriya, Yusuke Ijima |
| 2023 | ICASSP | Zero-Shot Text-to-Speech Synthesis Conditioned Using Self-Supervised Speech Representation Model. | Kenichi Fujita, Takanori Ashihara, Hiroki Kanagawa, Takafumi Moriya, Yusuke Ijima |
| 2023 | ICASSP | Enhancement of Text-Predicting Style Token With Generative Adversarial Network for Expressive Speech Synthesis. | Hiroki Kanagawa, Yusuke Ijima |
| 2023 | Interspeech | VC-T: Streaming Voice Conversion Based on Neural Transducer. | Hiroki Kanagawa, Takafumi Moriya, Yusuke Ijima |
| 2022 | ICASSP | Multi-Sample Subband Wavernn Via Multivariate Gaussian. | Hiroki Kanagawa, Yusuke Ijima |
| 2022 | Interspeech | Joint Modeling of Multi-Sample and Subband Signals for Fast Neural Vocoding on CPU. | Hiroki Kanagawa, Yusuke Ijima, Hiroyuki Toda |
| 2020 | Interspeech | Lightweight LPCNet-Based Neural Vocoder with Tensor Decomposition. | Hiroki Kanagawa, Yusuke Ijima |
| 2013 | ICASSP | Speaker-independent style conversion for HMM-based expressive speech synthesis. | Hiroki Kanagawa, Takashi Nose, Takao Kobayashi |