Skip to content

STOA-VLP: Spatial-Temporal Modeling of Object and Action for Video-Language Pre-training.

Weihong Zhong, Mao Zheng, Duyu Tang, Xuan Luo, Heng Gong, Xiaocheng Feng, Bing Qin

VenueA*AAAI
Year2023
ProceedingsAAAI

Browse the full AAAI paper archive.