Building a Multi-modal Spatiotemporal Expert for Zero-shot Action Recognition with CLIP.
Yating Yu, Congqi Cao, Yueran Zhang, Qinyi Lv, Lingtong Min, Yanning Zhang
Browse the full AAAI paper archive.
Yating Yu, Congqi Cao, Yueran Zhang, Qinyi Lv, Lingtong Min, Yanning Zhang
Browse the full AAAI paper archive.