Skip to content

Learning Contextually Fused Audio-Visual Representations For Audio-Visual Speech Recognition.

Ziqiang Zhang, Jie Zhang, Jianshu Zhang, Ming-Hui Wu, Xin Fang, Lirong Dai

VenueBICIP
Year2022
ProceedingsICIP

Browse the full ICIP paper archive.