Vocabulary-Free Fine-Grained Visual Recognition via Enriched Contextually Grounded Vision-Language Model.
Dmitry Demidov, Zaigham Zaheer, Omkar Thawakar, Salman H. Khan, Fahad Shahbaz Khan
Browse the full ICCV paper archive.
Dmitry Demidov, Zaigham Zaheer, Omkar Thawakar, Salman H. Khan, Fahad Shahbaz Khan
Browse the full ICCV paper archive.