Speaker consistency loss and step-wise optimization for semi-supervised joint training of TTS and ASR using unpaired text data.
Naoki Makishima, Satoshi Suzuki, Atsushi Ando, Ryo Masumura
Browse the full Interspeech paper archive.
Naoki Makishima, Satoshi Suzuki, Atsushi Ando, Ryo Masumura
Browse the full Interspeech paper archive.