Skip to content

MLCA-AVSR: Multi-Layer Cross Attention Fusion Based Audio-Visual Speech Recognition.

He Wang, Pengcheng Guo, Pan Zhou, Lei Xie

Year2024
ProceedingsICASSP

Browse the full ICASSP paper archive.