Skip to content

WIT: Wikipedia-based Image Text Dataset for Multimodal Multilingual Machine Learning.

Krishna Srinivasan, Karthik Raman, Jiecao Chen, Michael Bendersky, Marc Najork

VenueA*SIGIR
Year2021
ProceedingsSIGIR

Browse the full SIGIR paper archive.