Skip to content

A Challenging Multimodal Video Summary: Simultaneously Extracting and Generating Keyframe-Caption Pairs from Video.

Keito Kudo, Haruki Nagasawa, Jun Suzuki, Nobuyuki Shimizu

VenueA*EMNLP
Year2023
ProceedingsEMNLP

Browse the full EMNLP paper archive.