Gated Multi-modal Fusion with Cross-modal Contrastive Learning for Video Question Answering.
Chenyang Lyu, Wenxi Li, Tianbo Ji, Liting Zhou, Cathal Gurrin
Browse the full ICANN paper archive.
Chenyang Lyu, Wenxi Li, Tianbo Ji, Liting Zhou, Cathal Gurrin
Browse the full ICANN paper archive.