ROD-MLLM: Towards More Reliable Object Detection in Multimodal Large Language Models.
Heng Yin, Yuqiang Ren, Ke Yan, Shouhong Ding, Yongtao Hao
Browse the full CVPR paper archive.
Heng Yin, Yuqiang Ren, Ke Yan, Shouhong Ding, Yongtao Hao
Browse the full CVPR paper archive.