LLaVA-SG: Leveraging Scene Graphs as Visual Semantic Expression in Vision-Language Models.
Jingyi Wang, Jianzhong Ju, Jian Luan, Zhidong Deng
Browse the full ICASSP paper archive.
Jingyi Wang, Jianzhong Ju, Jian Luan, Zhidong Deng
Browse the full ICASSP paper archive.