| 2026 | Bridging the Gaps: Learning to Estimate Missing Text in Fragmentary Greek Inscriptions. | Silvia Zottin, Axel De Nardin, Maddalena Zunino, Valentina Mignosa, Gian Luca Foresti |
| 2026 | A MambaVision-Based Cross-Modal Feature Enhancement Network for Scene Text Super-Resolution. | Ruichang Zhu, Hongxi Wei, Bo Sun, Heng Wang |
| 2026 | DocCenter: Center and Corner Aware Representation for Robust Multi-document Localization. | Mengyuan Zhao, Kun Xu, Xin Cheng, Ting Li, Qiuman Tan, Xinyao Zhang |
| 2026 | G2I: A Progressive Structure-to-Detail Curriculum Training Strategy for Handwritten Mathematical Expression Recognition. | Minzhi Zhang, Xingxiang Zhou, Ziming Li, Jie Zhang, Zhi Chen, Xiangdong Su |
| 2026 | HME-Leibniz: A Multi-level Mathematical Expression Dataset from Leibniz's Manuscripts. | Yejing Xie, Ze Qian, Yunfan Li, Harold Mouchre, David Rabouin |
| 2026 | DeChart: A Benchmark and Text-Enhanced Chart-to-Table Conversion Method with Multimodal LLMs. | Chen-Yu Xie, Xiao-Hui Li, Fei Yin, Cheng-Lin Liu |
| 2026 | MaPE-Former: A Mask-Aware Position Encoding Network for Chinese Character Image Restoration. | Wei Wei, Xinrui Liu, Jianxin Zhang, Xiaodong Duan |
| 2026 | Parameter-Efficient and Adaptive Fine-Tuning for Long-Tailed Ancient Characters Recognition. | Hao Wang, Aouaidjia Kamel, Constantine Kotropoulos, Chongsheng Zhang |
| 2026 | Leveraging Morphology for Historical Script Metrological Analysis. | Malamatenia Vlachou-Efstathiou, Raphal Baena, Dominique Stutzmann, Mathieu Aubry |
| 2026 | MultiFOLD: A Multimodal Framework to Correct OCR Lapses in Cluttered Documents. | Rajat Verma, Vriti Sharma, Manikandan Ravikiran, Rohit Saluja |
| 2026 | Generalized Open-set Single-shot Character Recognition on Ancient Egyptian Hieratic Characters. | Stephan M. Unter, Chang Liu, Elisa H. Barney Smith |
| 2026 | DDD - A Diagnostic Dataset for Character Recognition and Detection on Ancient Egyptian Hieratic Characters and Words. | Stephan M. Unter, Elena L. Hertel |
| 2026 | Hierarchical Stroke-Level Clustering and Step-Level Segmentation for Automatic Scoring of Geometric Construction Answers with an Electronic Drawing Compass. | Thanh-Nghia Truong, Hung Tuan Nguyen, Nam Tuan Ly, Yoichi Tsuchida, Hiroshi Miyazawa, Tomo Asakura, Masamitsu Ito, Toshihiko Horie, Fumiko Yasuno, Masaki Nakagawa |
| 2026 | Angkorian-KSI: A Multi-task Benchmark for Khmer Stone Inscription Analysis. | Nimol Thuon, Jun Du, Ranysakol Thuon, Panhapin Theang |
| 2026 | Token Selection Strategies for Automatic Summarization of Historical Documents. | Merlin Streilein, Tobias Steiner, Andreas Fischer, Kaspar Riesen |
| 2026 | Benchmarking Information Retrieval for Large Archives of Historical Documents. | Tobias Steiner, Merlin Streilein, Andreas Fischer, Kaspar Riesen |
| 2026 | Patram-Bench: A Multi-task, Multi-domain and Multi-lingual Benchmark for Indian Document Image Understanding. | Anirudh Srinivasan, Pratyush Jena, Arya Topale, Venkata Kesav Venna, Ravi Kiran Sarvadevabhatla |
| 2026 | Synthetic Data from Simulated Lecture Environments for Handwritten Content Extraction. | Min Song, Kenny Davila |
| 2026 | Conversational Retrieval and On-the-Fly Knowledge Modeling of Historical Penitentiary Repression Records. | Paula Font Sol, Adri Molina Rodrguez, Josep Llads Canet |
| 2026 | Multi-modal Heterogeneous Music Notation Recognition from Documents: A Framework for Real-Time Symbolic-to-Immersive Mapping. | Ankit Sinha, Atanu Saha, Chiranjoy Chattopadhyay, Rahul Kumar Ray |
| 2026 | Few-Shot Writer Adaptation via Multimodal In-Context Learning. | Tom Simon, Pierrick Tranouez, Stphane Nicolas, Clment Chatelain, Thierry Paquet |
| 2026 | EpiSAM: Character Segmentation in Challenging Stone Inscriptions. | Arnav Sharma, Pratyush Jena, Amal Joseph, Ravi Kiran Sarvadevabhatla |
| 2026 | Synth-JDoc: Synthesizing a Japanese Document Image Dataset for OCR with Diverse Layouts and Embedded Images. | Keito Sasagawa, Shuhei Kurita, Daisuke Kawahara |
| 2026 | BinDiffuser: Learning Binarization Style Priors to Guide Diffusion Models for Palm-Leaf Document Binarization. | K. H. Salman, Chakravarthy Bhagvati |
| 2026 | LiteDoc: Distilling Large Document Models into Efficient Task-Specific Encoders. | Tayyab Raza, Syed Muhammad Taha Imam, Adrian Ulges, Ulrich Schwanecke, Momina Moetesum, Faisal Shafait |