Towards Fine-grained Audio Captioning with Multimodal Contextual Fusion.
Shunian Chen, Xinyuan Xie, Zheshu Chen, Owen Lee, Liyan Zhao, Zhan Su, Qilin Sun, Benyou Wang
Browse the full ACL paper archive.
Shunian Chen, Xinyuan Xie, Zheshu Chen, Owen Lee, Liyan Zhao, Zhan Su, Qilin Sun, Benyou Wang
Browse the full ACL paper archive.