Skip to content

Task-aware Cross-modal Feature Refinement Transformer with Large Language Models for Visual Grounding.

Wenbo Chen, Zhen Xu, Ruotao Xu, Si Wu, Hau-San Wong

VenueA*CVPR
Year2025
ProceedingsCVPR

Browse the full CVPR paper archive.