VoCoT: Unleashing Visually Grounded Multi-Step Reasoning in Large Multi-Modal Models.
Zejun Li, Ruipu Luo, Jiwen Zhang, Minghui Qiu, Xuanjing Huang, Zhongyu Wei
Browse the full NAACL paper archive.
Zejun Li, Ruipu Luo, Jiwen Zhang, Minghui Qiu, Xuanjing Huang, Zhongyu Wei
Browse the full NAACL paper archive.