Enhancing Automated Audio Captioning via Large Language Models with Optimized Audio Encoding.
Jizhong Liu, Gang Li, Junbo Zhang, Heinrich Dinkel, Yongqing Wang, Zhiyong Yan, Yujun Wang, Bin Wang
Browse the full Interspeech paper archive.
Jizhong Liu, Gang Li, Junbo Zhang, Heinrich Dinkel, Yongqing Wang, Zhiyong Yan, Yujun Wang, Bin Wang
Browse the full Interspeech paper archive.