Skip to content

Large Language Models are Strong Audio-Visual Speech Recognition Learners.

Umberto Cappellazzo, Minsu Kim, Honglie Chen, Pingchuan Ma, Stavros Petridis, Daniele Falavigna, Alessio Brutti, Maja Pantic

Year2025
ProceedingsICASSP

Browse the full ICASSP paper archive.