Skip to content

Self-Supervised Audio-Visual Speech Representations Learning by Multimodal Self-Distillation.

Jing-Xuan Zhang, Genshun Wan, Zhen-Hua Ling, Jia Pan, Jianqing Gao, Cong Liu

Year2023
ProceedingsICASSP

Browse the full ICASSP paper archive.