Skip to content

Towards Efficient Audio-Visual Learners via Empowering Pre-trained Vision Transformers with Cross-Modal Adaptation.

Kai Wang, Yapeng Tian, Dimitrios Hatzinakos

VenueA*CVPR
Year2024
ProceedingsCVPR Workshops

Browse the full CVPR paper archive.