Skip to content

Jointly Modeling Deep Video and Compositional Text to Bridge Vision and Language in a Unified Framework.

Ran Xu, Caiming Xiong, Wei Chen, Jason J. Corso

VenueA*AAAI
Year2015
ProceedingsAAAI

Browse the full AAAI paper archive.