Watch, Listen, and Describe: Globally and Locally Aligned Cross-Modal Attentions for Video Captioning.
Xin Wang, Yuan-Fang Wang, William Yang Wang
Browse the full NAACL paper archive.
Xin Wang, Yuan-Fang Wang, William Yang Wang
Browse the full NAACL paper archive.