Polos: Multimodal Metric Learning from Human Feedback for Image Captioning.
Yuiga Wada, Kanta Kaneda, Daichi Saito, Komei Sugiura
Browse the full CVPR paper archive.
Yuiga Wada, Kanta Kaneda, Daichi Saito, Komei Sugiura
Browse the full CVPR paper archive.