Learning Contextual Tag Embeddings for Cross-Modal Alignment of Audio and Tags.
Xavier Favory, Konstantinos Drossos, Tuomas Virtanen, Xavier Serra
Browse the full ICASSP paper archive.
Xavier Favory, Konstantinos Drossos, Tuomas Virtanen, Xavier Serra
Browse the full ICASSP paper archive.