Visual Context-driven Audio Feature Enhancement for Robust End-to-End Audio-Visual Speech Recognition.
Joanna Hong, Minsu Kim, Daehun Yoo, Yong Man Ro
Browse the full Interspeech paper archive.
Joanna Hong, Minsu Kim, Daehun Yoo, Yong Man Ro
Browse the full Interspeech paper archive.