Investigating Compositional Challenges in Vision-Language Models for Visual Grounding.
Yunan Zeng, Yan Huang, Jinjin Zhang, Zequn Jie, Zhenhua Chai, Liang Wang
Browse the full CVPR paper archive.
Yunan Zeng, Yan Huang, Jinjin Zhang, Zequn Jie, Zhenhua Chai, Liang Wang
Browse the full CVPR paper archive.