Enhancing Visual-Language Modality Alignment in Large Vision Language Models via Self-Improvement.
Xiyao Wang, Jiuhai Chen, Zhaoyang Wang, Yuhang Zhou, Yiyang Zhou, Huaxiu Yao, Tianyi Zhou, Tom Goldstein, Parminder Bhatia, Taha A. Kass-Hout, Furong Huang, Cao Xiao
Browse the full NAACL paper archive.