Skip to content

DocKylin: A Large Multimodal Model for Visual Document Understanding with Efficient Visual Slimming.

Jiaxin Zhang, Wentao Yang, Songxuan Lai, Zecheng Xie, Lianwen Jin

VenueA*AAAI
Year2025
ProceedingsAAAI

Browse the full AAAI paper archive.