Recurrence-Enhanced Vision-and-Language Transformers for Robust Multimodal Document Retrieval.
Davide Caffagni, Sara Sarto, Marcella Cornia, Lorenzo Baraldi, Rita Cucchiara
Browse the full CVPR paper archive.
Davide Caffagni, Sara Sarto, Marcella Cornia, Lorenzo Baraldi, Rita Cucchiara
Browse the full CVPR paper archive.