Enhancing Large Vision-Language Models with Ultra-Detailed Image Caption Generation.
Yu Zeng, Yukun Qi, Yiming Zhao, Xikun Bao, Lin Chen, Zehui Chen, Shiting Huang, Jie Zhao, Feng Zhao
Browse the full EMNLP paper archive.
Yu Zeng, Yukun Qi, Yiming Zhao, Xikun Bao, Lin Chen, Zehui Chen, Shiting Huang, Jie Zhao, Feng Zhao
Browse the full EMNLP paper archive.