Skip to content

SAM-CLIP: Merging Vision Foundation Models towards Semantic and Spatial Understanding.

Haoxiang Wang, Pavan Kumar Anasosalu Vasu, Fartash Faghri, Raviteja Vemulapalli, Mehrdad Farajtabar, Sachin Mehta, Mohammad Rastegari, Oncel Tuzel, Hadi Pouransari

VenueA*CVPR
Year2024
ProceedingsCVPR Workshops

Browse the full CVPR paper archive.