Benchmarking Large Vision-Language Models via Directed Scene Graph for Comprehensive Image Captioning.
Fan Lu, Wei Wu, Kecheng Zheng, Shuailei Ma, Biao Gong, Jiawei Liu, Wei Zhai, Yang Cao, Yujun Shen, Zheng-Jun Zha
Browse the full CVPR paper archive.