Learning Contextually Fused Audio-Visual Representations For Audio-Visual Speech Recognition.
Ziqiang Zhang, Jie Zhang, Jianshu Zhang, Ming-Hui Wu, Xin Fang, Lirong Dai
Browse the full ICIP paper archive.
Ziqiang Zhang, Jie Zhang, Jianshu Zhang, Ming-Hui Wu, Xin Fang, Lirong Dai
Browse the full ICIP paper archive.