Skip to content

CrossMAE: Cross-Modality Masked Autoencoders for Region-Aware Audio-Visual Pre-Training.

Yuxin Guo, Siyang Sun, Shuailei Ma, Kecheng Zheng, Xiaoyi Bao, Shijie Ma, Wei Zou, Yun Zheng

VenueA*CVPR
Year2024
ProceedingsCVPR

Browse the full CVPR paper archive.