Referring Expressions as a Lens into Spatial Language Grounding in Vision-Language Models.
Akshar Tumu, Varad Shinde, Parisa Kordjamshidi
Browse the full IJCNLP paper archive.
Akshar Tumu, Varad Shinde, Parisa Kordjamshidi
Browse the full IJCNLP paper archive.