Skip to content

Referring Expressions as a Lens into Spatial Language Grounding in Vision-Language Models.

Akshar Tumu, Varad Shinde, Parisa Kordjamshidi

VenueBIJCNLP
Year2025
ProceedingsIJCNLP-AACL (long papers)

Browse the full IJCNLP paper archive.