CORD: Bridging the Audio-Text Reasoning Gap via Weighted On-policy Cross-modal Distillation.
Hu Jing, Danxiang Zhu, Xianlong Luo, Dan Zhang, Shuwei He, Yishu Lei, Shikun Feng, Hai-Tao Zheng, Jingzhou He, Yu Sun, Hua Wu, Haifeng Wang
Browse the full ACL paper archive.