| 2025 | A Unified Model for Paragraph and Line-Level Handwritten Text Recognition. | Ernest Yu Kai Chew, Adams Wai-Kin Kong, Joo-Hwee Lim |
| 2025 | MIDV-UP: A Dataset of Pakistani and Iranian ID Documents. | Yulia S. Chernyshova, Daniil A. Ilyukhin, Vladimir V. Arlazarov |
| 2025 | SCANS: An Efficient Geometric Problem Solver with Content-Aware Attention and Adaptive Fusion. | Zhi Chen, Yuhan Yang, Xiangdong Su, Haoran Zhang, Xinxiang Zhou, Wei Chen, Guanglai Gao |
| 2025 | SemSyn-LCE: A Charge Prediction Method Based on Semantic Syntactic Fusion and Legal Constituent Elements Matching. | Wenjun Chen, Bianxia Du, Wenhui Xia, Qiao Hu, Yupeng Hu |
| 2025 | A Lightweight Context-Driven Training-Free Network for Scene Text Segmentation and Recognition. | Ritabrata Chakraborty, Palaiahnakote Shivakumara, Umapada Pal, Cheng-Lin Liu |
| 2025 | Towards Understanding the Logical Layout of Scene Text in Signboard Images. | Giang Tran Thi Cam, Cam-Nguyen Tran-Nhu, Thuyen Tran Doan, Thanh Duc Ngo |
| 2025 | Enhancing Khmer-English Machine Translation via Document Analysis Techniques. | Rina Buoy, Sovisal Chenda, Nguonly Taing, Marry Kong, Masakazu Iwamura, Koichi Kise |
| 2025 | EroPT: Benchmarking Robustness of OCR Methods on Eroded Printed Text. | Gyan Singh Budhiraja, Shrey Chandola, Anandita Jamwal, Manikandan Ravikiran, Rohit Saluja |
| 2025 | SynFinTabs: A Dataset of Synthetic Financial Tables for Information and Table Extraction. | Ethan Bradley, Muhammad Roman, Karen Rafferty, Barry Devereux |
| 2025 | Personality Trait Prediction from Twitter Data Using Text and Image Features. | Kunal Biswas, Shivakumara Palaiahnakote, Umapada Pal, Daniel P. Lopresti, Tong Lu |
| 2025 | Hierarchical Structure Understanding in Complex Tables with VLLMs: a Benchmark and Experiments. | Luca Bindini, Simone Giovannini, Simone Marinai, Valeria Nardoni, Kimiya Noor Ali |
| 2025 | Where Layout Meets Language: Lightweight Spatial Enhancement to Large Language Models for Document Understanding. | Nil Biescas, Sanket Biswas, Josep Llads, Jordy Van Landeghem |
| 2025 | Adapting Vision-Language Models for Hindi OCR. | Shaon Bhattacharyya, Souvik Ghosh, Prantik Deb, Ajoy Mondal, C. V. Jawahar |
| 2025 | Improving OCR Using Internal Document Redundancy. | Diego Belzarena, Seginus Mowlavi, Aitor Artola, Camilo Mario, Marina Gardella, Ignacio Ramrez, Antoine Tadros, Roy Y. He, Natalia Bottaioli, Boshra Rajaei, Gregory Randall, Jean-Michel Morel |
| 2025 | Multi-task Learning for Hebrew Paleography: Script Classification and Date Estimation. | Nour Atamni, Boraq Madi, Shoshana Bordman, Daria Vasyutinsky Shapira, Irina Rabaev, Jihad El-Sana |
| 2025 | HePU: Hebrew Paleography Understanding Dataset For Semantic Script Segmentation. | Nour Atamni, Boraq Madi, Islam Amar, Said Naamneh, Raid Saabni, Jihad El-Sana |
| 2025 | GAN-Based Content-Conditioned Generation of Handwritten Musical Symbols. | Gerard Asbert, Pau Torras, Lei Kang, Alicia Forns, Josep Llads |
| 2025 | Evaluating Handwritten Text Recognition in Medieval Notarial Manuscripts: A New Dataset and Comprehensive Analysis. | Mariona Coll Ardanuy, Iban Berganzo-Besga, Ramon Sarobe, Coral Cuadrada |
| 2025 | HoLoSig: Holistic and Local Representation Learning for Online Signature Verification. | Joo Pedro Felix de Almeida, Lucas De Almeida Bandeira Macedo, Pedro Garcia Freitas |
| 2025 | A Unified Attention-Based Model for Segmenting Compound Words in Sanskrit. | Irfan Ali, Liliana Lo Presti, Igor Spano, Marco La Cascia |
| 2025 | Federated Unlearning with Clustered Asynchronous Aggregation and Ensemble Learning for Efficient Privacy-Preserving Document Analysis. | Ahmad Sarmad Ali, Momina Moetesum, Faisal Shafait, Adnan Ul-Hasan |
| 2025 | Text Enhancement of Degraded Historical Documents. | Reem Alaasam, Boraq Madi, Jihad El-Sana |
| 2025 | Semi-supervised Writing Style Classification in Medieval Hebrew Manuscripts. | Reem Alaasam, Jihad El-Sana, Irina Rabaev, Daria Vasyutinsky Shapira |
| 2025 | Few-Part-Shot Font Generation. | Masaki Akiba, Shumpei Takezaki, Daichi Haraguchi, Seiichi Uchida |
| 2025 | Uncertainty-Aware Complex Scientific Table Data Extraction. | Kehinde Ajayi, Yi He, Jian Wu |