Skip to content

MIRTT: Learning Multimodal Interaction Representations from Trilinear Transformers for Visual Question Answering.

Junjie Wang, Yatai Ji, Jiaqi Sun, Yujiu Yang, Tetsuya Sakai

VenueA*EMNLP
Year2021
ProceedingsEMNLP (Findings)

Browse the full EMNLP paper archive.