Skip to content

SyncVSR: Data-Efficient Visual Speech Recognition with End-to-End Crossmodal Audio Token Synchronization.

Youngjin Ahn, Jungwoo Park, Sangha Park, Jonghyun Choi, Kee-Eung Kim

Year2024
ProceedingsINTERSPEECH

Browse the full Interspeech paper archive.