SA-CLIP: Language Guided Image Spatial and Action Feature Learning.
Guanlin Li, Wenhao Shao, Praboda Rajapaksha, Nol Crespi
Browse the full EMNLP paper archive.
Guanlin Li, Wenhao Shao, Praboda Rajapaksha, Nol Crespi
Browse the full EMNLP paper archive.