Skip to content

Aligning Multimodal Data for Fine-Grained Video Understanding via Cross-Attentive Recurrent Fusion.

Nam-Ho Kim, Jun-Hwa Kim

VenueA*ICCV
Year2025
ProceedingsICCVW

Browse the full ICCV paper archive.