| 2024 | ICASSP | Enhancing Multilingual TTS with Voice Conversion Based Data Augmentation and Posterior Embedding. | Hyun-Wook Yoon, Jin-Seob Kim, Ryuichi Yamamoto, Ryo Terashima, Chan-Ho Song, Jae-Min Kim, Eunwoo Song |
| 2023 | Interspeech | Cross-Lingual Transfer Learning for Phrase Break Prediction with Multilingual Language Model. | Hoyeon Lee, Hyun-Wook Yoon, Jong-Hwan Kim, Jae-Min Kim |
| 2023 | Interspeech | Pruning Self-Attention for Zero-Shot Multi-Speaker Text-to-Speech. | Hyungchan Yoon, Changhwan Kim, Eunwoo Song, Hyun-Wook Yoon, Hong-Goo Kang |
| 2022 | Interspeech | TTS-by-TTS 2: Data-Selective Augmentation for Neural Speech Synthesis Using Ranking Support Vector Machine with Variational Autoencoder. | Eunwoo Song, Ryuichi Yamamoto, Ohsung Kwon, Chan-Ho Song, Min-Jae Hwang, Suhyeon Oh, Hyun-Wook Yoon, Jin-Seob Kim, Jae-Min Kim |
| 2022 | Interspeech | Cross-Speaker Emotion Transfer for Low-Resource Text-to-Speech Using Non-Parallel Voice Conversion with Pitch-Shift Data Augmentation. | Ryo Terashima, Ryuichi Yamamoto, Eunwoo Song, Yuma Shirahata, Hyun-Wook Yoon, Jae-Min Kim, Kentaro Tachibana |
| 2022 | Interspeech | Language Model-Based Emotion Prediction Methods for Emotional Speech Synthesis Systems. | Hyun-Wook Yoon, Ohsung Kwon, Hoyeon Lee, Ryuichi Yamamoto, Eunwoo Song, Jae-Min Kim, Min-Jae Hwang |
| 2021 | AAAI | Multi-SpectroGAN: High-Diversity and High-Fidelity Spectrogram Generation with Adversarial Style Combination for Speech Synthesis. | Sang-Hoon Lee, Hyun-Wook Yoon, Hyeong-Rae Noh, Ji-Hoon Kim, Seong-Whan Lee |
| 2020 | Interspeech | Audio Dequantization for High Fidelity Audio Generation in Flow-Based Neural Vocoder. | Hyun-Wook Yoon, Sang-Hoon Lee, Hyeong-Rae Noh, Seong-Whan Lee |