Mask-Vit: an Object Mask Embedding in Vision Transformer for Fine-Grained Visual Classification.
Tong Su, Shuo Ye, Chengqun Song, Jun Cheng
Browse the full ICIP paper archive.
Tong Su, Shuo Ye, Chengqun Song, Jun Cheng
Browse the full ICIP paper archive.