Skip to content

Multimodal Large Language Models for Text-rich Image Understanding: A Comprehensive Review.

Pei Fu, Tongkun Guan, Zining Wang, Zhentao Guo, Chen Duan, Hao Sun, Boming Chen, Qianyi Jiang, Jiayao Ma, Kai Zhou, Junfeng Luo

VenueA*ACL
Year2025
ProceedingsACL (Findings)

Browse the full ACL paper archive.