SoundLoCD: An Efficient Conditional Discrete Contrastive Latent Diffusion Model for Text-to-Sound Generation.
Xinlei Niu, Jing Zhang, Christian Walder, Charles Patrick Martin
Browse the full ICASSP paper archive.
Xinlei Niu, Jing Zhang, Christian Walder, Charles Patrick Martin
Browse the full ICASSP paper archive.