Skip to content

From Pixels to Graphs: Open-Vocabulary Scene Graph Generation with Vision-Language Models.

Rongjie Li, Songyang Zhang, Dahua Lin, Kai Chen, Xuming He

VenueA*CVPR
Year2024
ProceedingsCVPR

Browse the full CVPR paper archive.