Real-Time Neural Text-to-Speech with Sequence-to-Sequence Acoustic Model and WaveGlow or Single Gaussian WaveRNN Vocoders.
Takuma Okamoto, Tomoki Toda, Yoshinori Shiga, Hisashi Kawai
Browse the full Interspeech paper archive.
Takuma Okamoto, Tomoki Toda, Yoshinori Shiga, Hisashi Kawai
Browse the full Interspeech paper archive.