HiRes-LLaVA: Restoring Fragmentation Input in High-Resolution Large Vision-Language Models.
Runhui Huang, Xinpeng Ding, Chunwei Wang, Jianhua Han, Yulong Liu, Hengshuang Zhao, Hang Xu, Lu Hou, Wei Zhang, Xiaodan Liang
Browse the full CVPR paper archive.