Skip to content

Efficient End-to-End Video Question Answering with Pyramidal Multimodal Transformer.

Min Peng, Chongyang Wang, Yu Shi, Xiang-Dong Zhou

VenueA*AAAI
Year2023
ProceedingsAAAI

Browse the full AAAI paper archive.