MIA-DPO: Multi-Image Augmented Direct Preference Optimization For Large Vision-Language Models.
Ziyu Liu, Yuhang Zang, Xiaoyi Dong, Pan Zhang, Yuhang Cao, Haodong Duan, Conghui He, Yuanjun Xiong, Dahua Lin, Jiaqi Wang
Browse the full ICLR paper archive.