| 2025 | BengaliDiff: Diffusion Model for Few-Shot Bengali Font Generation. | Md Bilayet Hossain, Honghui Yuan, Shabnur Anonna Akhy, Keiji Yanai |
| 2025 | SelectVision: Adaptive Vision Resolution Selection for Visual Document Understanding. | Zhongjiang He, Ye Yuan, An Zhao, Han Fang, Hao Sun, Kongming Liang, Zhanyu Ma |
| 2025 | MultKMAWE: A Multi Key-Points Based Word Extraction Algorithm for Manchu Archives. | Jianjun He, Xiaoxuan Ma, Tian Tian, Yu Zhou, Wenpeng Liu, Ruirui Zheng |
| 2025 | Entity-Dependency Memory-Enhanced Document-Level Relation Extraction. | Li He, Hu Li, Jianyong Duan, Jie Liu, Hao Wang, Qing Zhang |
| 2025 | TMAWS: A Manchu Archives Word Spotting Method Supporting Both Image and String Query Modes. | Jianjun He, Ligen Cheng, Zihang Zhang, Yu Zhou, Xinshu Cui, Ruirui Zheng |
| 2025 | Total Disentanglement of Font Images Into Style and Character Class Features. | Daichi Haraguchi, Wataru Shimoda, Kota Yamaguchi, Seiichi Uchida |
| 2025 | Fusing Text Semantics for Text Image Inpainting. | Conghao Han, Mengyang Duan, Anna Zhu |
| 2025 | Adaptive Radical Similarity Learning for Chinese Character Recognition. | Zhongyuan Han, Jun Du, Pengfei Hu, Mobai Xue |
| 2025 | A New Fourier-Attention Guided Approach for Domain-Agnostic Text Localization. | Arnab Halder, Shivakumara Palaiahnakote, Umapada Pal, Michael Blumenstein, Yue Lu |
| 2025 | ResNet-TPP: A Parallel PHOC-PHOS Framework for Zero-Shot Handwritten Word Recognition in Low-Resource Scripts. | Aniket Gurav, Sukalpa Chanda, Marius Pedersen |
| 2025 | Beyond Memorization: Training-Free Style Mixing for Variability in Handwritten Text Generation Using Writer Embedding Injection in Pretrained Diffusion Models. | Aniket Gurav, Sukalpa Chanda, Narayanan C. Krishnan |
| 2025 | Modular OCR Using Web Scraping Data. | Guy Gisfan, Eli (Omid) David, Nathan S. Netanyahu |
| 2025 | Table Detection with Active Learning. | Somraj Gautam, Nachiketa Purohit, Gaurav Harit |
| 2025 | TextSAM-LoRA: Efficient Fine-Tuning of Segment Anything Model for Text Detection with Low-Rank Adaptation. | Carlos de la Fuente, Adrin Snchez-Hernndez, Jorge Calvo-Zaragoza |
| 2025 | DocPINN: A Neural PDE-Based Framework for Document Image Dewarping. | Guangrui Fan |
| 2025 | KD-LSRED : Knowledge Distillation for Lightweight Symbol Recognition in Engineering Diagrams. | Ikenna Ekeke, Carlos Francisco Moreno-Garca, Eyad Elyan |
| 2025 | LDTR: Linear Object Detection Transformer for Accurate Graph Generation by Learning the N-Hop Connectivity Information. | Weiwei Duan, Yao-Yi Chiang, Craig A. Knoblock |
| 2025 | Layout-Aware Text Editing for Efficient Transformation of Academic PDFs to Markdown. | Changxu Duan |
| 2025 | Skeleton-Guided Artistic Text Recognition. | Tien Do, Thuyen Tran, Khiem Le, Duy-Dinh Le, Thanh Duc Ngo |
| 2025 | Position-Aware Stamp-Like Adversarial Attack for Document Classification. | Qi Dong, Lei Kang, Maura Pintor, Dimosthenis Karatzas |
| 2025 | HisDoc-DETR: Integrating Semantic Learning and Feature Fusion for Historical Document Layout Analysis. | Kai Ding, Sheng Jian, Lianwen Jin |
| 2025 | BiNet: A Deep Encoder-Decoder Network for Binarizing Degraded Ancient Manuscripts. | Maruf A. Dhali, Jan Willem de Wit, Lambert Schomaker |
| 2025 | Multidisciplinary End-to-End Document-Level Relation Extraction from Scientific Literature. | Julien Delaunay, Tran Thi Hong Hanh, Carlos-Emiliano Gonzlez-Gallardo, Georgeta Bordea, Nicolas Sidere, Antoine Doucet, Olivier de Viron |
| 2025 | Multi-type Tibetan Ancient Book Text Line Recognition Based on Adapter Fine-Tuning. | Feixiang Cui, Dorje Tashi, Yong Tso, Nyima Tashi |
| 2025 | Rx-PAD: Recognition and eXtraction - A Dataset for Prescription Analysis and Clinical Data Structuring. | Jonathan Pattin Cottet, Vronique Eglin, Alexandre Aussem |