Skip to content

Hourglass-AVSR: Down-Up Sampling-Based Computational Efficiency Model for Audio-Visual Speech Recognition.

Fan Yu, Haoxu Wang, Ziyang Ma, Shiliang Zhang

Year2024
ProceedingsICASSP

Browse the full ICASSP paper archive.