MIRTT: Learning Multimodal Interaction Representations from Trilinear Transformers for Visual Question Answering.
Junjie Wang, Yatai Ji, Jiaqi Sun, Yujiu Yang, Tetsuya Sakai
Browse the full EMNLP paper archive.
Junjie Wang, Yatai Ji, Jiaqi Sun, Yujiu Yang, Tetsuya Sakai
Browse the full EMNLP paper archive.