| 2024 | ICDAR 2024 Competition on Multi Font Group Recognition and OCR. | Janne van der Loop, Florian Kordon, Martin Mayr, Vincent Christlein, Fei Wu, Dalia Rodrguez-Salas, Nikolaus Weichselbaumer, Mathias Seuret |
| 2024 | Adaptive Scaling and Refined Pyramid Feature Fusion Network for Scene Text Segmentation. | Tian-Zuo Li, Heng Zhang, Xiao-Hui Li, Fei Yin |
| 2024 | LABT: A Sequence-to-Sequence Model for Mongolian Handwritten Text Recognition with Local Aggregation BiLSTM and Transformer. | Yu Li, Hongxi Wei, Shiwen Sun |
| 2024 | Extractive Question Answering with Contrastive Puzzles and Reweighted Clues. | Chao Liu, Jie Yang, Wanqing Li |
| 2024 | Context-Aware Confidence Estimation for Rejection in Handwritten Chinese Text Recognition. | Yangyang Liu, Yi Chen, Fei Yin, Cheng-Lin Liu |
| 2024 | MOoSE: Multi-Orientation Sharing Experts for Open-Set Scene Text Recognition. | Chang Liu, Simon Corbill, Elisa H. Barney Smith |
| 2024 | Deep Metric Learning with Cross-Writer Attention for Offline Signature Verification. | Lu-Rong Ling, Heng Zhang, Fei Yin, Cheng-Lin Liu |
| 2024 | ICDAR 2024 Competition on Historical Map Text Detection, Recognition, and Linking. | Zekun Li, Yijun Lin, Yao-Yi Chiang, Jerod J. Weinman, Solenn Tual, Joseph Chazalon, Julien Perret, Bertrand Dumnieu, Nathalie Abadie |
| 2024 | Recognition of Components in Taoist Charm Images. | Ting-Wei Liao, Hsiang-An Wang |
| 2024 | DistilDoc: Knowledge Distillation for Visually-Rich Document Applications. | Jordy Van Landeghem, Subhajit Maity, Ayan Banerjee, Matthew B. Blaschko, Marie-Francine Moens, Josep Llads, Sanket Biswas |
| 2024 | LAPDoc: Layout-Aware Prompting for Documents. | Marcel Lamott, Yves-Noel Weweler, Adrian Ulges, Faisal Shafait, Dirk Krechel, Darko Obradovic |
| 2024 | YOLO Assisted A* Algorithm for Robust Line Segmentation of Degraded Document Images. | Ahana Kundu, Ujjwal Bhattacharya |
| 2024 | IndicBART Alongside Visual Element: Multimodal Summarization in Diverse Indian Languages. | Raghvendra Kumar, Deepak Prakash, Sriparna Saha, Shubham Sharma |
| 2024 | Fully Automatic Virtual Unwrapping Method for Documents Imaged by X-Ray Tomography. | Petr Kulagin, Dmitry Polevoy, Marina V. Chukalina, Dmitry P. Nikolaev, Vladimir V. Arlazarov |
| 2024 | SPRINT: Script-agnostic Structure Recognition in Tables. | Dhruv Kudale, Badri Vishal Kasuba, Venkatapathy Subramanian, Parag Chaudhuri, Ganesh Ramakrishnan |
| 2024 | Impression-CLIP: Contrastive Shape-Impression Embedding for Fonts. | Yugo Kubota, Daichi Haraguchi, Seiichi Uchida |
| 2024 | Reformulating Key-Information Extraction as Next Sentence Prediction for Hierarchical Data. | Ashish Kubade, Prathyusha Akundi, Bilal Arif Syed Mohd |
| 2024 | Investigating Neural Networks and Transformer Models for Enhanced Comic Decoding. | Eleanna Kouletou, Vassilis Papavassiliou, Vassilis Katsouros |
| 2024 | GARDEN: Generative Prior Guided Network for Scene Text Image Super-Resolution. | Yuxin Kong, Weihong Ma, Lianwen Jin, Yang Xue |
| 2024 | Font Style Interpolation with Diffusion Models. | Tetta Kondo, Shumpei Takezaki, Daichi Haraguchi, Seiichi Uchida |
| 2024 | Loghi: An End-to-End Framework for Making Historical Documents Machine-Readable. | Rutger van Koert, Stefan Klut, Tim Koornstra, Martijn Maas, Luke Peters |
| 2024 | Font Impression Estimation in the Wild. | Kazuki Kitajima, Daichi Haraguchi, Seiichi Uchida |
| 2024 | Self-supervised Pre-training of Text Recognizers. | Martin Kiss, Michal Hradis |
| 2024 | Callico: A Versatile Open-Source Document Image Annotation Platform. | Christopher Kermorvant, Eva Bardou, Manon Blanco, Bastien Abadie |
| 2024 | Multi-cell Decoder and Mutual Learning for Table Structure and Character Recognition. | Takaya Kawakatsu |