Multimodal Transformer with Variable-Length Memory for Vision-and-Language Navigation.
Chuang Lin, Yi Jiang, Jianfei Cai, Lizhen Qu, Gholamreza Haffari, Zehuan Yuan
Browse the full ECCV paper archive.
Chuang Lin, Yi Jiang, Jianfei Cai, Lizhen Qu, Gholamreza Haffari, Zehuan Yuan
Browse the full ECCV paper archive.