Parameter Efficient Audio Captioning with Faithful Guidance Using Audio-Text Shared Latent Representation.
Arvind Krishna Sridhar, Yinyi Guo, Erik Visser, Rehana Mahfuz
Browse the full ICASSP paper archive.
Arvind Krishna Sridhar, Yinyi Guo, Erik Visser, Rehana Mahfuz
Browse the full ICASSP paper archive.