Beyond Image-Text Matching: Verb Understanding in Multimodal Transformers Using Guided Masking.
Ivana Benov, Jana Kosecka, Michal Gregor, Martin Tamajka, Marcel Vesel, Marin Simko
Browse the full SOFSEM paper archive.
Ivana Benov, Jana Kosecka, Michal Gregor, Martin Tamajka, Marcel Vesel, Marin Simko
Browse the full SOFSEM paper archive.