Spatiotemporal Representation Enhanced ViT for Video Recognition.
Min Li, Fengfa Li, Bo Meng, Ruwen Bai, Junxing Ren, Zihao Huang, Chenghua Gao
Browse the full MMM paper archive.
Min Li, Fengfa Li, Bo Meng, Ruwen Bai, Junxing Ren, Zihao Huang, Chenghua Gao
Browse the full MMM paper archive.