Skip to content

Token-Efficient VLM: High-Resolution Image Understanding Via Dynamic Region Proposal.

Yitong Jiang, Jinwei Gu, Tianfan Xue, Ka Chun Cheung, Pavlo Molchanov, Hongxu Yin, Sifei Liu

VenueA*ICCV
Year2025
ProceedingsICCV

Browse the full ICCV paper archive.