UMT: Unified Multi-modal Transformers for Joint Video Moment Retrieval and Highlight Detection.
Ye Liu, Siyuan Li, Yang Wu, Chang Wen Chen, Ying Shan, Xiaohu Qie
Browse the full CVPR paper archive.
Ye Liu, Siyuan Li, Yang Wu, Chang Wen Chen, Ying Shan, Xiaohu Qie
Browse the full CVPR paper archive.