Structure-CLIP: Towards Scene Graph Knowledge to Enhance Multi-Modal Structured Representations.
Yufeng Huang, Jiji Tang, Zhuo Chen, Rongsheng Zhang, Xinfeng Zhang, Weijie Chen, Zeng Zhao, Zhou Zhao, Tangjie Lv, Zhipeng Hu, Wen Zhang
Browse the full AAAI paper archive.