Jointly Modeling Deep Video and Compositional Text to Bridge Vision and Language in a Unified Framework.
Ran Xu, Caiming Xiong, Wei Chen, Jason J. Corso
Browse the full AAAI paper archive.
Ran Xu, Caiming Xiong, Wei Chen, Jason J. Corso
Browse the full AAAI paper archive.