ViT-CoMer: Vision Transformer with Convolutional Multi-scale Feature Interaction for Dense Predictions.
Chunlong Xia, Xinliang Wang, Feng Lv, Xin Hao, Yifeng Shi
Browse the full CVPR paper archive.
Chunlong Xia, Xinliang Wang, Feng Lv, Xin Hao, Yifeng Shi
Browse the full CVPR paper archive.