Skip to content

Speech Guided Masked Image Modeling for Visually Grounded Speech.

Jongbhin Woo, Hyeonggon Ryu, Arda Senocak, Joon Son Chung

Year2024
ProceedingsICASSP

Browse the full ICASSP paper archive.