Skip to content

Watch, Listen, and Describe: Globally and Locally Aligned Cross-Modal Attentions for Video Captioning.

Xin Wang, Yuan-Fang Wang, William Yang Wang

VenueANAACL
Year2018
ProceedingsNAACL-HLT (2)

Browse the full NAACL paper archive.