Skip to content

ViGoR: Improving Visual Grounding of Large Vision Language Models with Fine-Grained Reward Modeling.

Siming Yan, Min Bai, Weifeng Chen, Xiong Zhou, Qixing Huang, Li Erran Li

VenueA*ECCV
Year2024
ProceedingsECCV (61)

Browse the full ECCV paper archive.