CoMT: A Novel Benchmark for Chain of Multi-modal Thought on Large Vision-Language Models.
Zihui Cheng, Qiguang Chen, Jin Zhang, Hao Fei, Xiaocheng Feng, Wanxiang Che, Min Li, Libo Qin
Browse the full AAAI paper archive.
Zihui Cheng, Qiguang Chen, Jin Zhang, Hao Fei, Xiaocheng Feng, Wanxiang Che, Min Li, Libo Qin
Browse the full AAAI paper archive.