Multimodal embedding fusion for robust speaker role recognition in video broadcast.
Mickael Rouvier, Sebastien Delecraz, Benot Favre, Meriem Bendris, Frdric Bchet
Browse the full ASRU paper archive.
Mickael Rouvier, Sebastien Delecraz, Benot Favre, Meriem Bendris, Frdric Bchet
Browse the full ASRU paper archive.