Skip to content

Visual Context-driven Audio Feature Enhancement for Robust End-to-End Audio-Visual Speech Recognition.

Joanna Hong, Minsu Kim, Daehun Yoo, Yong Man Ro

Year2022
ProceedingsINTERSPEECH

Browse the full Interspeech paper archive.