Skip to content

Polos: Multimodal Metric Learning from Human Feedback for Image Captioning.

Yuiga Wada, Kanta Kaneda, Daichi Saito, Komei Sugiura

VenueA*CVPR
Year2024
ProceedingsCVPR

Browse the full CVPR paper archive.