INViTE: INterpret and Control Vision-Language Models with Text Explanations.
Haozhe Chen, Junfeng Yang, Carl Vondrick, Chengzhi Mao
Browse the full ICLR paper archive.
Haozhe Chen, Junfeng Yang, Carl Vondrick, Chengzhi Mao
Browse the full ICLR paper archive.