A Challenging Multimodal Video Summary: Simultaneously Extracting and Generating Keyframe-Caption Pairs from Video.
Keito Kudo, Haruki Nagasawa, Jun Suzuki, Nobuyuki Shimizu
Browse the full EMNLP paper archive.
Keito Kudo, Haruki Nagasawa, Jun Suzuki, Nobuyuki Shimizu
Browse the full EMNLP paper archive.