XTTS: a Massively Multilingual Zero-Shot Text-to-Speech Model.
Edresson Casanova, Kelly Davis, Eren Glge, Grkem Gknar, Iulian Gulea, Logan Hart, Aya Aljafari, Joshua Meyer, Reuben Morais, Samuel Olayemi, Julian Weber
Browse the full Interspeech paper archive.