Activating Visual Context and Commonsense Reasoning Through Masked Prediction in VLMs.
Jiaao Yu, Shenwei Li, Mingjie Han, Yifei Yin, Wenzheng Song, Chenghao Jia, Man Lan
Browse the full AAAI paper archive.
Jiaao Yu, Shenwei Li, Mingjie Han, Yifei Yin, Wenzheng Song, Chenghao Jia, Man Lan
Browse the full AAAI paper archive.