Skip to content

CLAP-ART: Automated Audio Captioning with Semantic-rich Audio Representation Tokenizer.

Daiki Takeuchi, Binh Thien Nguyen, Masahiro Yasuda, Yasunori Ohishi, Daisuke Niizumi, Noboru Harada

Year2025
ProceedingsINTERSPEECH

Browse the full Interspeech paper archive.