Towards Diverse and Efficient Audio Captioning via Diffusion Models.
Manjie Xu, Chenxing Li, Yong Ren, Xinyi Tu, Ruibo Fu, Wei Liang, Dong Yu
Browse the full Interspeech paper archive.
Manjie Xu, Chenxing Li, Yong Ren, Xinyi Tu, Ruibo Fu, Wei Liang, Dong Yu
Browse the full Interspeech paper archive.