Masked Lip-Sync Prediction by Audio-Visual Contextual Exploitation in Transformers.
Yasheng Sun, Hang Zhou, Kaisiyuan Wang, Qianyi Wu, Zhibin Hong, Jingtuo Liu, Errui Ding, Jingdong Wang, Ziwei Liu, Hideki Koike
Browse the full SiggraphA paper archive.