| 2026 | GRACE: Gradient-Regulated Approach for Consistent Explanations. | Sayantan Basu |
| 2026 | Text Region Detection in Historical Astronomical Diagrams. | Zeynep Sonat Baltaci, Raphal Baena, Fei Meng, Somko Norindr, Florence Somer, Matthieu Husson, Mathieu Aubry |
| 2026 | GLiDRE: Generalist Lightweight Model for Document-Level Relation Extraction. | Robin Armingaud, Romaric Besanon |
| 2026 | Doc2Doc: Structure-Aware Generative Rendering for Bi-directional Document Translation. | Fahad Al-Otaibi, Daulet Toibazar, Renad A. Alnuaim, Ranya A. Alkahtani, Haneen A. Alhomoud, Asma A. Ibrahim, Yazeed Alharbi, Murtadha Al-Jubran, Pedro J. Moreno |
| 2026 | Automatic Layout Detection in Historical Civil Records Using Deep Object Detection. | Wissam AlKendi, Franck Gechter, Laurent Heyberger, Christophe Guyeux |
| 2026 | HIDRA: Hierarchical Ink-Aware Dual-Granularity Retrieval Architecture for Historical Fragments. | Jihad Al Akl, Chady Abou Jaoude, Zahi Al Chami, Marianne Abi Kanaan, Abdallah Makhoul |
| 2026 | Figures as Evidence: Multi-image Scientific Generation. | Jawad Ibn Ahad, Mritunjoy Chakraborty, Fuad Rahman, Sifat Momen, Shafin Rahman, Nabeel Mohammed |
| 2025 | Boosting Handwritten Mathematical Expression Recognition Through Contextual Reasoning with Vision Large Language Models (vLLMs). | Merouane Zouaid, Yejing Xie, Harold Mouchre |
| 2025 | ICDAR 2025 Competition on FEw-Shot Text Line Segmentation of Ancient Handwritten Documents (FEST). | Silvia Zottin, Axel De Nardin, Giuseppe Branca, Claudio Piciarelli, Gian Luca Foresti |
| 2025 | DAA-Net: Dynamic Adaptive Aggregation Network for Document Image Rectification. | Xinyue Zhou, Nanfeng Jiang, Da-Han Wang, Wang Man |
| 2025 | VLMAWR: A Method for Manchu Archives Word Recognition Based on Vision-Language Model. | Yu Zhou, Zhengxu Jin, Jianjun He, Baochun Wu, Xinshu Cui, Ruirui Zheng |
| 2025 | MCCD: A Multi-attribute Chinese Calligraphy Character Dataset Annotated with Script Styles, Dynasties, and Calligraphers. | Yixin Zhao, Yuyi Zhang, Lianwen Jin |
| 2025 | CHSAM: Efficient Scene Text Segmentation via SAM with Convolutional Adapters and Hierarchical Decoding. | Jing-Yao Zhang, Heng Zhang, Fei Yin |
| 2025 | SigLDiff: A Signature Based Latent Diffusion Model for Forged-Free Offline Signature Verification. | Mingjian Zhang, Lidong Zheng, Jiaen Chen, Yichi Zhang, Yuchen Zheng |
| 2025 | InfoDesignLM: An LLM for Interactive and Controllable Infographic Designing Through Text. | Xilin Zhang, Hao Wang, Jianbiao Dai, Pinpin Zhu |
| 2025 | ICDAR 2025 Competition on End-to-End Document Image Machine Translation Towards Complex Layouts. | Yaping Zhang, Yupu Liang, Zhiyang Zhang, Zhiyuan Chen, Lu Xiang, Yang Zhao, Yu Zhou, Chengqing Zong |
| 2025 | Class-Agnostic Region-of-Interest Matching in Document Images. | Demin Zhang, Jiahao Lyu, Zhijie Shen, Yu Zhou |
| 2025 | Large Language Models for Online Log Parsing in AIOps. | Suqiong Zhang, Dongyi Fan, Yi Liu, Lili He, Zuohua Ding |
| 2025 | ICDAR 2025 Competition on Understanding Chinese College Entrance Exam Papers. | Wenhao Yu, Tianrui Zong, He Zhang, Lin Yang, He Yang, Guanhao Wu, Ruohua Xu, Qinqin Yan, Liangcai Gao |
| 2025 | Towards Cross-Modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution. | Junyi Yuan, Jian Zhang, Fangyu Wu, Huanda Lu, Dongming Lu, Qiufeng Wang |
| 2025 | Japanese Kuzushiji Font Generation Employing Differentiable Renderer. | Honghui Yuan, Junwen Chen, Keiji Yanai |
| 2025 | A Handwritten Text Recognition Dataset for Ajami Manuscripts in Fulfulde and Hausa. | Oreen Yousuf, Abdulmalik Aminu, Musa Salih Muhammad, Bashir Usman, Mustapha Kurfi Hashim, Joakim Nivre, Beta Megyesi, Christian Hgel |
| 2025 | Inverse Scene Text Removal. | Takumi Yoshimatsu, Shumpei Takezaki, Seiichi Uchida |
| 2025 | Att-BiGRU-MulCNN: A New Approach for Intent Classification in Apple Pest and Disease. | Liu Yong, Yuanshuang Miao, Lyuwen Huang |
| 2025 | A Unified Framework for Knowledge-Intensive Numerical Reasoning over Financial Document. | Long Yin, Kai Yin, Hui Zhao |