Skip to content

Vision Transformers are Parameter-Efficient Audio-Visual Learners.

Yan-Bo Lin, Yi-Lin Sung, Jie Lei, Mohit Bansal, Gedas Bertasius

VenueA*CVPR
Year2023
ProceedingsCVPR

Browse the full CVPR paper archive.