Skip to content

Zero-AVSR: Zero-Shot Audio-Visual Speech Recognition with LLMs by Learning Language-Agnostic Speech Representations.

Jeong Hun Yeo, Minsu Kim, Chae Won Kim, Stavros Petridis, Yong Man Ro

VenueA*ICCV
Year2025
ProceedingsICCV

Browse the full ICCV paper archive.