Skip to content

Beyond Image-Text Matching: Verb Understanding in Multimodal Transformers Using Guided Masking.

Ivana Benov, Jana Kosecka, Michal Gregor, Martin Tamajka, Marcel Vesel, Marin Simko

VenueBSOFSEM
Year2025
ProceedingsSOFSEM (1)

Browse the full SOFSEM paper archive.