StyleTTS-ZS: Efficient High-Quality Zero-Shot Text-to-Speech Synthesis with Distilled Time-Varying Style Diffusion.
Yinghao Aaron Li, Xilin Jiang, Cong Han, Nima Mesgarani
Browse the full NAACL paper archive.
Yinghao Aaron Li, Xilin Jiang, Cong Han, Nima Mesgarani
Browse the full NAACL paper archive.