| 2025 | Scene Script Identification Using Dense Hierarchical Semantic Fusion. | Yaowei Yang, Zhonghua Sun, Kaisaier Tuerxun, Kurban Ubul |
| 2025 | Multi-scale Convolution Combined with DTW for Online Signature Verification. | Dengshan Yang, Mahpirat Muhammat, Xuebin Xu, Alimjan Aysa, Kurban Ubul |
| 2025 | FCD-Net: Frequency and Contrastive Learning-Driven Network for Document Image Shadow Removal. | Fan Yang, Nanfeng Jiang, Da-Han Wang, Yun Wu |
| 2025 | UniOne: A Document Parsing Dataset for Cross Task Association Modeling. | Runqing Yan, Jianye An |
| 2025 | SPS-CG: Shape, Pronunciation, and Semantic Joint Modeling for Chinese Character Generation. | Mobai Xue, Jun Du, Pengfei Hu |
| 2025 | TableCall: Boosting Table Question Answering with Tool-Driven Training-Free LLMs. | Chun-Bo Xu, Yi-Ming Chen, Xiao-Hui Li, Fei Yin, Cheng-Lin Liu |
| 2025 | Deep Learning for Defect Detection in Answer Document Image. | Jun Xie, Yiming Xia, Sailong Wu, Ruiqing Wu, Yirong Chen |
| 2025 | Text Detection in Industrial Design Drawings via Multi-dimensional Feature Fusion and Differentiable Binarization. | Mingzhao Xie, Wandong Xue, Dongming Chen, Dongqi Wang |
| 2025 | TST: Tree Structured Transformer for Handwritten Mathematical Expression Recognition. | Yejing Xie, Harold Mouchre |
| 2025 | ColorGPT: Leveraging Large Language Models for Multimodal Color Recommendation. | Ding Xia, Naoto Inoue, Qianru Qiu, Kotaro Kikuchi |
| 2025 | OracleGCD: Generalized Category Discovery for Oracle Bone Scripts. | Hetao Wu, Kunchi Li, Xu-Yao Zhang, Qiufeng Wang, Da-Han Wang |
| 2025 | CM1 - A Dataset for Evaluating Few-Shot Information Extraction with Large Vision Language Models. | Fabian Wolf, Oliver Tselmann, Arthur Matei, Lukas Hennies, Christoph Rass, Gernot A. Fink |
| 2025 | A Multimodal Evaluation Pipeline for Mathematical Expression Recognition: Comparisons of Datasets, Metrics, and Models. | Franois Wieckowiak, Vronique Eglin, Tony Bonnet, Stphane Bres, Latitia Rousseau |
| 2025 | T-LLaVA: An Effective Saliency-Aware Slicing Strategy for Text Recognition. | Mengze Wei, Chun Yang, Min Liang, Fang Zhou, Xiaobin Zhu, Xu-Cheng Yin |
| 2025 | SSSI: Self-prompted Segmentation of Scientific Illustrations. | Tuo Wang, Yixiao Zhou, Tongwei Zhang, Zhicheng He, Yumeng Zhao, Xiaoqing Lyu |
| 2025 | HiDReader: Human-Inspired Document Reading Agent via Reinforcement Learning. | Changqing Wang, Hao Wang, Pinpin Zhu, Huiran Zhang |
| 2025 | Offline Handwritten Mathematical Formula Recognition Based on Primitive Representation. | Yaqi Wang, Hui Wang, Yuanping Zhu |
| 2025 | SFRD: Handwritten Mathematical Expressions Generation by Spatial-Aware Feature Refinement Diffusion. | Yiming Wang, Hongxi Wei, Heng Wang, Shiwen Sun |
| 2025 | VMF-Net: Visual-Aware Multi-representation Fusion Network for Artifact-Free Handwritten Mathematical Expressions Generation. | Yiming Wang, Hongxi Wei, Heng Wang, Bo Sun |
| 2025 | DCC: Plug-and-Play Dynamic Category Compression for Enhanced Handwritten Text Generation. | Yiming Wang, Hongxi Wei, Heng Wang, Shiwen Sun |
| 2025 | SANet: Multi-scale Dynamic Aggregation for Chinese Handwriting Recognition. | Sizhu Wang, Yingshan Shen, Xiaofeng Yuan |
| 2025 | Template-Guided Cascaded Diffusion for Stylized Handwritten Chinese Text-Line Generation. | Honglie Wang, Minsi Ren, Yan-Ming Zhang, Fei Yin, Cheng-Lin Liu |
| 2025 | Improving Handwritten Text Recognition via 3D Attention and Multi-scale Training. | Zi-Rui Wang |
| 2025 | RefChartQA: Grounding Visual Answer on Chart Images Through Instruction Tuning. | Alexander Vogel, Omar Moured, Yufan Chen, Jiaming Zhang, Rainer Stiefelhagen |
| 2025 | ComicsPAP: Understanding Comic Strips by Picking the Correct Panel. | Emanuele Vivoli, Artemis Llabrs, Mohamed Ali Souibgui, Marco Bertini, Ernest Valveny Llobet, Dimosthenis Karatzas |