Text-Infused Audio-Visual Video Parsing with Semantic-Aware Multimodal Contrastive Learning.
Pengcheng Zhao, Yanxiang Chen, Dan Guo, Yuanzhi Yao
Browse the full ICASSP paper archive.
Pengcheng Zhao, Yanxiang Chen, Dan Guo, Yuanzhi Yao
Browse the full ICASSP paper archive.