Skip to content

ViT-CoMer: Vision Transformer with Convolutional Multi-scale Feature Interaction for Dense Predictions.

Chunlong Xia, Xinliang Wang, Feng Lv, Xin Hao, Yifeng Shi

VenueA*CVPR
Year2024
ProceedingsCVPR

Browse the full CVPR paper archive.