SpatialCLIP: Learning 3D-aware Image Representations from Spatially Discriminative Language.
Zehan Wang, Sashuai Zhou, Shaoxuan He, Haifeng Huang, Lihe Yang, Ziang Zhang, Xize Cheng, Shengpeng Ji, Tao Jin, Hengshuang Zhao, Zhou Zhao
Browse the full CVPR paper archive.