Single-stage TTS with Masked Audio Token Modeling and Semantic Knowledge Distillation.
Gerard I. Gllego, Roy Fejgin, Chunghsin Yeh, Xiaoyu Liu, Gautam Bhattacharya
Browse the full ICASSP paper archive.
Gerard I. Gllego, Roy Fejgin, Chunghsin Yeh, Xiaoyu Liu, Gautam Bhattacharya
Browse the full ICASSP paper archive.