Skip to content

Multi-Modal Perception Attention Network with Self-Supervised Learning for Audio-Visual Speaker Tracking.

Yidi Li, Hong Liu, Hao Tang

VenueA*AAAI
Year2022
ProceedingsAAAI

Browse the full AAAI paper archive.