Do Vision-Language Models Represent Space and How? Evaluating Spatial Frame of Reference under Ambiguities.
Zheyuan Zhang, Fengyuan Hu, Jayjun Lee, Freda Shi, Parisa Kordjamshidi, Joyce Chai, Ziqiao Ma
Browse the full ICLR paper archive.
Zheyuan Zhang, Fengyuan Hu, Jayjun Lee, Freda Shi, Parisa Kordjamshidi, Joyce Chai, Ziqiao Ma
Browse the full ICLR paper archive.