A Joint Cross-Attention Model for Audio-Visual Fusion in Dimensional Emotion Recognition.
R. Gnana Praveen, Wheidima Carneiro de Melo, Nasib Ullah, Haseeb Aslam, Osama Zeeshan, Tho Denorme, Marco Pedersoli, Alessandro L. Koerich, Simon Bacon, Patrick Cardinal, Eric Granger
Browse the full CVPR paper archive.