ProsodyFlow: High-fidelity Text-to-Speech through Conditional Flow Matching and Prosody Modeling with Large Speech Language Models.
Haoyu Wang, Sizhe Shan, Yinlin Guo, Yuehai Wang
Browse the full COLING paper archive.
Haoyu Wang, Sizhe Shan, Yinlin Guo, Yuehai Wang
Browse the full COLING paper archive.