Skip to content

Beyond a Pre-Trained Object Detector: Cross-Modal Textual and Visual Context for Image Captioning.

Chia-Wen Kuo, Zsolt Kira

VenueA*CVPR
Year2022
ProceedingsCVPR

Browse the full CVPR paper archive.