Skip to content

Looking Similar, Sounding Different: Leveraging Counterfactual Cross-Modal Pairs for Audiovisual Representation Learning.

Nikhil Singh, Chih-Wei Wu, Iroro Orife, Mahdi M. Kalayeh

VenueA*CVPR
Year2024
ProceedingsCVPR

Browse the full CVPR paper archive.