GRAVL-BERT: Graphical Visual-Linguistic Representations for Multimodal Coreference Resolution.
Danfeng Guo, Arpit Gupta, Sanchit Agarwal, Jiun-Yu Kao, Shuyang Gao, Arijit Biswas, Chien-Wei Lin, Tagyoung Chung, Mohit Bansal
Browse the full COLING paper archive.