ViGoR: Improving Visual Grounding of Large Vision Language Models with Fine-Grained Reward Modeling.
Siming Yan, Min Bai, Weifeng Chen, Xiong Zhou, Qixing Huang, Li Erran Li
Browse the full ECCV paper archive.
Siming Yan, Min Bai, Weifeng Chen, Xiong Zhou, Qixing Huang, Li Erran Li
Browse the full ECCV paper archive.