Learning to Generate Grounded Visual Captions Without Localization Supervision.
Chih-Yao Ma, Yannis Kalantidis, Ghassan AlRegib, Peter Vajda, Marcus Rohrbach, Zsolt Kira
Browse the full ECCV paper archive.
Chih-Yao Ma, Yannis Kalantidis, Ghassan AlRegib, Peter Vajda, Marcus Rohrbach, Zsolt Kira
Browse the full ECCV paper archive.