Skip to content

HiRes-LLaVA: Restoring Fragmentation Input in High-Resolution Large Vision-Language Models.

Runhui Huang, Xinpeng Ding, Chunwei Wang, Jianhua Han, Yulong Liu, Hengshuang Zhao, Hang Xu, Lu Hou, Wei Zhang, Xiaodan Liang

VenueA*CVPR
Year2025
ProceedingsCVPR

Browse the full CVPR paper archive.