Skip to content

SoundLoCD: An Efficient Conditional Discrete Contrastive Latent Diffusion Model for Text-to-Sound Generation.

Xinlei Niu, Jing Zhang, Christian Walder, Charles Patrick Martin

Year2024
ProceedingsICASSP

Browse the full ICASSP paper archive.