Skip to content

Few-Shot Action Scene Graph Generation from Video via Multimodal Language Models for Structuring Spatial Experience.

Jinseok Hong, Hyerim Park, Heejeong Ko, Woontack Woo

VenueA*ISMAR
Year2025
ProceedingsISMAR-Adjunct

Browse the full ISMAR paper archive.