Hourglass-AVSR: Down-Up Sampling-Based Computational Efficiency Model for Audio-Visual Speech Recognition.
Fan Yu, Haoxu Wang, Ziyang Ma, Shiliang Zhang
Browse the full ICASSP paper archive.
Fan Yu, Haoxu Wang, Ziyang Ma, Shiliang Zhang
Browse the full ICASSP paper archive.