Boosting Multi-modal Keyphrase Prediction with Dynamic Chain-of-Thought in Vision-Language Models.
Qihang Ma, Shengyu Li, Jie Tang, Dingkang Yang, Chenshaodong, Yingyi Zhang, Chao Feng, Ran Jiao
Browse the full EMNLP paper archive.
Qihang Ma, Shengyu Li, Jie Tang, Dingkang Yang, Chenshaodong, Yingyi Zhang, Chao Feng, Ran Jiao
Browse the full EMNLP paper archive.