Skip to content

Dimosthenis Karatzas

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

114

Venues

18

Active years

2002–2026

Best venue rank

A*

Where they publish

Papers

114 indexed papers, newest first.

YearVenueTitleAuthors
2026ICPRReading in the Dark: Low-Light Scene Text Recognition.Xuanshuo Fu, Lei Kang, Ernest Valveny, Dimosthenis Karatzas, Javier Vazquez-Corral
2026ICPRLearning Quantifiable Visual Explanations Without Ground-Truth.Amritpal Singh, Andrey Barsky, Mohamed Ali Souibgui, Ernest Valveny, Dimosthenis Karatzas
2025ICCVCoSMo: A Multimodal Transformer for Page Stream Segmentation in Comic Books.Marc Serra Ortega, Emanuele Vivoli, Artemis Llabrs, Dimosthenis Karatzas
2025ICDARPosition-Aware Stamp-Like Adversarial Attack for Document Classification.Qi Dong, Lei Kang, Maura Pintor, Dimosthenis Karatzas
2025ICDARLLM-Driven Medical Document Analysis: Enhancing Trustworthy Pathology and Differential Diagnosis.Lei Kang, Xuanshuo Fu, Oriol Ramos Terrades, Javier Vazquez-Corral, Ernest Valveny, Dimosthenis Karatzas
2025ICDARICDAR 2025 Handwritten Notes Understanding Challenge.Aniket Pal, Sanket Biswas, Alloy Das, Ayush Lodh, Priyanka Banerjee, Soumitri Chattopadhyay, Ajoy Mondal, Dimosthenis Karatzas, Josep Llads, C. V. Jawahar
2025ICDARComicsPAP: Understanding Comic Strips by Picking the Correct Panel.Emanuele Vivoli, Artemis Llabrs, Mohamed Ali Souibgui, Marco Bertini, Ernest Valveny Llobet, Dimosthenis Karatzas
2025ICLRDocMIA: Document-Level Membership Inference Attacks against DocVQA Models.Khanh Nguyen, Raouf Kerkouche, Mario Fritz, Dimosthenis Karatzas
2025ICMLDocVXQA: Context-Aware Visual Explanations for Document Question Answering.Mohamed Ali Souibgui, Changkyu Choi, Andrey Barsky, Kangsoo Jung, Ernest Valveny, Dimosthenis Karatzas
2024DASMulti-page Document VQA with Recurrent Memory Transformer.Qi Dong, Lei Kang, Dimosthenis Karatzas
2024DASImage-Text Matching for Large-Scale Book Collections.Artemis Llabrs, Arka Ujjal Dey, Dimosthenis Karatzas, Ernest Valveny
2024ECAIGRIF-DM: Generation of Rich Impression Fonts Using Diffusion Models.Lei Kang, Fei Yang, Kai Wang, Mohamed Ali Souibgui, Llus Gmez, Alicia Forns, Ernest Valveny, Dimosthenis Karatzas
2024ECCVComiCap: A VLMs Pipeline for Dense Captioning of Comic Panels.Emanuele Vivoli, Niccol Biondi, Marco Bertini, Dimosthenis Karatzas
2024ICDARMachine Unlearning for Document Classification.Lei Kang, Mohamed Ali Souibgui, Fei Yang, Llus Gmez, Ernest Valveny, Dimosthenis Karatzas
2024ICDARMulti-page Document Visual Question Answering Using Self-attention Scoring Mechanism.Lei Kang, Rubn Tito, Ernest Valveny, Dimosthenis Karatzas
2024ICDARFederated Document Visual Question Answering: A Pilot Study.Khanh Nguyen, Dimosthenis Karatzas
2024ICDARPrivacy-Aware Document Visual Question Answering.Rubn Tito, Khanh Nguyen, Marlon Tobaben, Raouf Kerkouche, Mohamed Ali Souibgui, Kangsoo Jung, Joonas Jlk, Vincent Poulain D'Andecy, Aurlie Joseph, Lei Kang, Ernest Valveny, Antti Honkela, Mario Fritz, Dimosthenis Karatzas
2024ICDARMultimodal Transformer for Comics Text-Cloze.Emanuele Vivoli, Joan Lafuente Baeza, Ernest Valveny Llobet, Dimosthenis Karatzas
2024ICDARComics Datasets Framework: Mix of Comics Datasets for Detection Benchmarking.Emanuele Vivoli, Irene Campaioli, Mariateresa Nardoni, Niccol Biondi, Marco Bertini, Dimosthenis Karatzas
2024ICDARCounting the Corner Cases: Revisiting Robust Reading Challenge Data Sets, Evaluation Protocols, and Metrics.Jerod J. Weinman, Amelia Gmez Grabowska, Dimosthenis Karatzas
2024WACVSTEP - Towards Structured Scene-Text Spotting.Sergi Garcia-Bordils, Dimosthenis Karatzas, Maral Rusiol
2023AAAIShow, Interpret and Tell: Entity-Aware Contextualised Image Captioning in Wikipedia.Khanh Nguyen, Ali Furkan Biten, Andrs Mafla, Llus Gmez, Dimosthenis Karatzas
2023AAAIText-DIAE: A Self-Supervised Degradation Invariant Autoencoder for Text Recognition and Document Enhancement.Mohamed Ali Souibgui, Sanket Biswas, Andrs Mafla, Ali Furkan Biten, Alicia Forns, Yousri Kessentini, Josep Llads, Llus Gmez, Dimosthenis Karatzas
2023ICDARAccelerating Transformer-Based Scene Text Detection and Recognition via Token Pruning.Sergi Garcia-Bordils, Dimosthenis Karatzas, Maral Rusiol
2023ICDARDocILE Benchmark for Document Information Localization and Extraction.Stepn Simsa, Milan Sulc, Michal Uricr, Yash Patel, Ahmed Hamdi, Matej Kocin, Matys Skalick, Jir Matas, Antoine Doucet, Mickal Coustaty, Dimosthenis Karatzas
2023ICDARICDAR 2023 Competition on RoadText Video Text Detection, Tracking and Recognition.George Tom, Minesh Mathew, Sergi Garcia-Bordils, Dimosthenis Karatzas, C. V. Jawahar
2023ICDARReading Between the Lanes: Text VideoQA on the Road.George Tom, Minesh Mathew, Sergi Garcia-Bordils, Dimosthenis Karatzas, C. V. Jawahar
2023ICDARICDAR 2023 Competition on Video Text Reading for Dense and Small Text.Weijia Wu, Yuzhong Zhao, Zhuang Li, Jiahong Li, Mike Zheng Shou, Umapada Pal, Dimosthenis Karatzas, Xiang Bai
2023ICDARICDAR 2023 Competition on Reading the Seal Title.Wenwen Yu, Mingyu Liu, Mingrui Chen, Ning Lu, Yinlong Wen, Yuliang Liu, Dimosthenis Karatzas, Xiang Bai
2023ICDARICDAR 2023 Competition on Structured Text Extraction from Visually-Rich Document Images.Wenwen Yu, Chengquan Zhang, Haoyu Cao, Wei Hua, Bohan Li, Huang Chen, Mingyu Liu, Mingrui Chen, Jianfeng Kuang, Mengjun Cheng, Yuning Du, Shikun Feng, Xiaoguang Hu, Pengyuan Lyu, Kun Yao, Yuechen Yu, Yuliang Liu, Wanxiang Che, Errui Ding, Cheng-Lin Liu, Jiebo Luo, Shuicheng Yan, Min Zhang, Dimosthenis Karatzas, Xing Sun, Jingdong Wang, Xiang Bai
2023WACVWatching the News: Towards VideoQA Models that can Read.Soumya Jahagirdar, Minesh Mathew, Dimosthenis Karatzas, C. V. Jawahar
2022DASRead While You Drive - Multilingual Text Tracking on the Road.Sergi Garcia-Bordils, George Tom, Sangeeth Reddy, Minesh Mathew, Maral Rusiol, C. V. Jawahar, Dimosthenis Karatzas
2022DASA Multilingual Approach to Scene Text Visual Question Answering.Josep Brugus i Pujolrs, Llus Gmez i Bigorda, Dimosthenis Karatzas
2022ECCVOCR-IDL: OCR Annotations for Industry Document Library Dataset.Ali Furkan Biten, Rubn Tito, Llus Gmez, Ernest Valveny, Dimosthenis Karatzas
2022ECCVOut-of-Vocabulary Challenge Report.Sergi Garcia-Bordils, Andrs Mafla, Ali Furkan Biten, Oren Nuriel, Aviad Aberdam, Shai Mazor, Ron Litman, Dimosthenis Karatzas
2022ECCVMUST-VQA: MUltilingual Scene-Text VQA.Emanuele Vivoli, Ali Furkan Biten, Andrs Mafla, Dimosthenis Karatzas, Llus Gmez
2022WACVLet there be a clock on the beach: Reducing Object Hallucination in Image Captioning.Ali Furkan Biten, Llus Gmez, Dimosthenis Karatzas
2022WACVIs An Image Worth Five Sentences? A New Look into Semantics for Image-Text Matching.Ali Furkan Biten, Andrs Mafla, Llus Gmez, Dimosthenis Karatzas
2022WACVInfographicVQA.Minesh Mathew, Viraj Bagal, Rubn Tito, Dimosthenis Karatzas, Ernest Valveny, C. V. Jawahar
2022WACVOne-shot Compositional Data Generation for Low Resource Handwritten Text Recognition.Mohamed Ali Souibgui, Ali Furkan Biten, Sounak Dey, Alicia Forns, Yousri Kessentini, Llus Gmez, Dimosthenis Karatzas, Josep Llads
2021ICDARDocument Collection Visual Question Answering.Rubn Tito, Dimosthenis Karatzas, Ernest Valveny
2021ICDARICDAR 2021 Competition on Document Visual Question Answering.Rubn Tito, Minesh Mathew, C. V. Jawahar, Ernest Valveny, Dimosthenis Karatzas
2021WACVMulti-Modal Reasoning Graph for Scene-Text Based Fine-Grained Image Classification and Retrieval.Andrs Mafla, Sounak Dey, Ali Furkan Biten, Llus Gmez, Dimosthenis Karatzas
2021WACVStacMR: Scene-Text Aware Cross-Modal Retrieval.Andrs Mafla, Rafael Sampaio de Rezende, Llus Gmez, Diane Larlus, Dimosthenis Karatzas
2021WACVDocVQA: A Dataset for VQA on Document Images.Minesh Mathew, Dimosthenis Karatzas, C. V. Jawahar
2020ECCVLocation Sensitive Image Retrieval and Tagging.Ral Gomez, Jaume Gibert, Llus Gmez, Dimosthenis Karatzas
2020ICPRText Recognition - Real World Data and Where to Find Them.Klra Janouskov, Jiri Matas, Llus Gmez, Dimosthenis Karatzas
2020ICRARoadText-1K: Text Detection & Recognition Dataset for Driving Videos.Sangeeth Reddy, Minesh Mathew, Llus Gmez, Maral Rusiol, Dimosthenis Karatzas, C. V. Jawahar
2020WACVExploring Hate Speech Detection in Multimodal Publications.Raul Gomez, Jaume Gibert, Llus Gmez, Dimosthenis Karatzas
2020WACVFine-grained Image Classification and Retrieval by Combining Visual and Locally Pooled Textual Features.Andrs Mafla, Sounak Dey, Ali Furkan Biten, Llus Gmez, Dimosthenis Karatzas
2019CVPRGood News, Everyone! Context Driven Entity-Aware Captioning for News Images.Ali Furkan Biten, Llus Gmez, Maral Rusiol, Dimosthenis Karatzas
2019ICCVScene Text Visual Question Answering.Ali Furkan Biten, Rubn Tito, Andrs Mafla, Llus Gmez i Bigorda, Maral Rusiol, C. V. Jawahar, Ernest Valveny, Dimosthenis Karatzas
2019ICDARCan One Deep Learning Model Learn Script-Independent Multilingual Word-Spotting?Mohammed Al-Rawi, Ernest Valveny, Dimosthenis Karatzas
2019ICDARICDAR 2019 Competition on Scene Text Visual Question Answering.Ali Furkan Biten, Rubn Tito, Andrs Mafla, Llus Gmez, Maral Rusiol, Minesh Mathew, C. V. Jawahar, Ernest Valveny, Dimosthenis Karatzas
2019ICDARICDAR2019 Robust Reading Challenge on Arbitrary-Shaped Text - RRC-ArT.Chee Kheng Chng, Errui Ding, Jingtuo Liu, Dimosthenis Karatzas, Chee Seng Chan, Lianwen Jin, Yuliang Liu, Yipeng Sun, Chun Chet Ng, Canjie Luo, Zihan Ni, ChuanMing Fang, Shuaitao Zhang, Junyu Han
2019ICDARSelective Style Transfer for Text.Raul Gomez, Ali Furkan Biten, Llus Gmez, Jaume Gibert, Dimosthenis Karatzas, Maral Rusiol
2019ICDARICDAR2019 Competition on Scanned Receipt OCR and Information Extraction.Zheng Huang, Kai Chen, Jianhua He, Xiang Bai, Dimosthenis Karatzas, Shijian Lu, C. V. Jawahar
2019ICDAREye-Movements During Information Extraction from Administrative Documents.Helena Muoz, Fernando Vilario, Dimosthenis Karatzas
2019ICDARICDAR2019 Robust Reading Challenge on Multi-lingual Scene Text Detection and Recognition - RRC-MLT-2019.Nibal Nayef, Cheng-Lin Liu, Jean-Marc Ogier, Yash Patel, Michal Busta, Pinaki Nath Chowdhury, Dimosthenis Karatzas, Wafa Khlif, Jiri Matas, Umapada Pal, Jean-Christophe Burie
2019ICDARICDAR 2019 Competition on Large-Scale Street View Text with Partial Labeling - RRC-LSVT.Yipeng Sun, Dimosthenis Karatzas, Chee Seng Chan, Lianwen Jin, Zihan Ni, Chee Kheng Chng, Yuliang Liu, Canjie Luo, Chun Chet Ng, Junyu Han, Errui Ding, Jingtuo Liu
2019ICDARICDAR 2019 Robust Reading Challenge on Reading Chinese Text on Signboard.Rui Zhang, Mingkun Yang, Xiang Bai, Baoguang Shi, Dimosthenis Karatzas, Shijian Lu, C. V. Jawahar, Yongsheng Zhou, Qianyi Jiang, Qi Song, Nan Li, Kai Zhou, Lei Wang, Dong Wang, Minghui Liao
2018CVPRWord Spotting in Scene Images Based on Character Recognition.Dena Bazazian, Dimosthenis Karatzas, Andrew D. Bagdanov
2018DASCutting Sayre's Knot: Reading Scene Text without Segmentation. Application to Utility Meters.Llus Gmez, Maral Rusiol, Dimosthenis Karatzas
2018DASThe Robust Reading Competition Annotation and Evaluation Platform.Dimosthenis Karatzas, Llus Gmez, Anguelos Nicolaou, Maral Rusiol
2018ECCVLearning to Learn from Web Data Through Deep Semantic Embeddings.Raul Gomez, Llus Gmez, Jaume Gibert, Dimosthenis Karatzas
2018ECCVLearning from #Barcelona Instagram Data What Locals and Tourists Post About Its Neighbourhoods.Raul Gomez, Llus Gmez, Jaume Gibert, Dimosthenis Karatzas
2018ECCVSingle Shot Scene Text Retrieval.Llus Gmez, Andrs Mafla, Maral Rusiol, Dimosthenis Karatzas
2017CVPRSelf-Supervised Learning of Visual Features through Embedding Images into Text Topic Spaces.Lluis Gomez-Bigorda, Yash Patel, Maral Rusiol, Dimosthenis Karatzas, C. V. Jawahar
2017ICDARLSDE: Levenshtein Space Deep Embedding for Query-by-String Word Spotting.Lluis Gomez-Bigorda, Maral Rusiol, Dimosthenis Karatzas
2017ICDARICDAR2017 Robust Reading Challenge on COCO-Text.Raul Gomez, Baoguang Shi, Lluis Gomez-Bigorda, Luks Neumann, Andreas Veit, Jiri Matas, Serge J. Belongie, Dimosthenis Karatzas
2017ICDARICDAR2017 Robust Reading Challenge on Omnidirectional Video.Masakazu Iwamura, Naoyuki Morimoto, Keishi Tainaka, Dena Bazazian, Lluis Gomez-Bigorda, Dimosthenis Karatzas
2017ICDARICDAR2017 Robust Reading Challenge on Multi-Lingual Scene Text Detection and Script Identification - RRC-MLT.Nibal Nayef, Fei Yin, Imen Bizid, Hyunsoo Choi, Yuan Feng, Dimosthenis Karatzas, Zhenbo Luo, Umapada Pal, Christophe Rigaud, Joseph Chazalon, Wafa Khlif, Muhammad Muzzamil Luqman, Jean-Christophe Burie, Cheng-Lin Liu, Jean-Marc Ogier
2017ICDARICDAR2017 Robust Reading Challenge on Text Extraction from Biomedical Literature Figures (DeTEXT).Chun Yang, Xu-Cheng Yin, Hong Yu, Dimosthenis Karatzas, Yu Cao
2016DASA Fine-Grained Approach to Scene Text Script Identification.Llus Gmez i Bigorda, Dimosthenis Karatzas
2016DASHuman-Document Interaction Systems - A New Frontier for Document Image Analysis.Dimosthenis Karatzas, Vincent Poulain D'Andecy, Maral Rusiol, Antonio Chica, Pere-Pau Vzquez Alcocer
2016DASVisual Script and Language Identification.Anguelos Nicolaou, Andrew D. Bagdanov, Lluis Gomez i Bigorda, Dimosthenis Karatzas
2016ECCVDynamic Lexicon Generation for Natural Scene Images.Yash Patel, Llus Gmez i Bigorda, Maral Rusiol, Dimosthenis Karatzas
2015ICDARObject proposals for text extraction in the wild.Llus Gmez i Bigorda, Dimosthenis Karatzas
2015ICDARNovel line verification for multiple instance focused retrieval in document collections.Hongxing Gao, Maral Rusiol, Dimosthenis Karatzas, Josep Llads, Rajiv Jain, David S. Doermann
2015ICDAREfficient indexing for Query By String text retrieval.Suman K. Ghosh, Llus Gmez i Bigorda, Dimosthenis Karatzas, Ernest Valveny
2015ICDARICDAR 2015 competition on Robust Reading.Dimosthenis Karatzas, Lluis Gomez-Bigorda, Anguelos Nicolaou, Suman K. Ghosh, Andrew D. Bagdanov, Masakazu Iwamura, Jiri Matas, Luks Neumann, Vijay Ramaseshan Chandrasekhar, Shijian Lu, Faisal Shafait, Seiichi Uchida, Ernest Valveny
2015ICDARSparse radial sampling LBP for writer identification.Anguelos Nicolaou, Andrew D. Bagdanov, Marcus Liwicki, Dimosthenis Karatzas
2015ISVCAutomatic Verification of Properly Signed Multi-page Document Images.Maral Rusiol, Dimosthenis Karatzas, Josep Llads
2014ACCVScene Text Recognition: No Country for Old Men?Llus Gmez i Bigorda, Dimosthenis Karatzas
2014DASA Cache Language Model for Whole Document Handwriting Recognition.Volkmar Frinken, Dimosthenis Karatzas, Andreas Fischer
2014DASAn On-line Platform for Ground Truthing and Performance Evaluation of Text Extraction Systems.Dimosthenis Karatzas, Sergi Robles Mestre, Lluis Gomez i Bigorda
2014DASColor Descriptor for Content-Based Drawing Retrieval.Christophe Rigaud, Dimosthenis Karatzas, Jean-Christophe Burie, Jean-Marc Ogier
2014ICPREmbedding Document Structure to Bag-of-Words through Pair-wise Stable Key-Regions.Hongxing Gao, Maral Rusiol, Dimosthenis Karatzas, Josep Llads
2014ICPRMSER-Based Real-Time Text Detection and Tracking.Llus Gmez i Bigorda, Dimosthenis Karatzas
2013IBPRIATowards Modelling an Attention-Based Text Localization Process.Antonio Clavelli, Dimosthenis Karatzas, Josep Llads, Mario Ferraro, Giuseppe Boccignone
2013ICDARKey-Region Detection for Document Images - Application to Administrative Document Retrieval.Hongxing Gao, Maral Rusiol, Dimosthenis Karatzas, Josep Llads, Tomokazu Sato, Masakazu Iwamura, Koichi Kise
2013ICDARMulti-script Text Extraction from Natural Scenes.Lluis Gomez i Bigorda, Dimosthenis Karatzas
2013ICDARDocument Classification and Page Stream Segmentation for Digital Mailroom Applications.Albert Gordo, Maral Rusiol, Dimosthenis Karatzas, Andrew D. Bagdanov
2013ICDARICDAR 2013 Robust Reading Competition.Dimosthenis Karatzas, Faisal Shafait, Seiichi Uchida, Masakazu Iwamura, Lluis Gomez i Bigorda, Sergi Robles Mestre, Joan Mas, David Fernndez Mota, Jon Almazn, Llus-Pere de las Heras
2013ICDARAn Active Contour Model for Speech Balloon Detection in Comics.Christophe Rigaud, Jean-Christophe Burie, Jean-Marc Ogier, Dimosthenis Karatzas, Joost van de Weijer
2013ICIPTowards multispectral data acquisition with hand-held devices.Rahat Khan, Joost van de Weijer, Dimosthenis Karatzas, Damien Muselet
2012ICPRMultipage document retrieval by textual and visual representations.Maral Rusiol, Dimosthenis Karatzas, Andrew D. Bagdanov, Josep Llads
2011ECIRInteractive Trademark Image Retrieval by Fusing Semantic and Visual Content.Maral Rusiol, David Aldavert, Dimosthenis Karatzas, Ricardo Toledo, Josep Llads
2011ICDARICDAR 2011 Robust Reading Competition - Challenge 1: Reading Text in Born-Digital Images (Web and Email).Dimosthenis Karatzas, Sergi Robles Mestre, Joan Mas, Farshad Nourbakhsh, Partha Pratim Roy
2010DASA framework for the assessment of text extraction algorithms on complex colour images.Antonio Clavelli, Dimosthenis Karatzas, Josep Llads
2010DASA polar-based logo representation based on topological and colour features.Farshad Nourbakhsh, Dimosthenis Karatzas, Ernest Valveny
2010ICPRPerceptual Image Retrieval by Adding Color Information to the Shape Context Descriptor.Maral Rusiol, Farshad Nourbakhsh, Dimosthenis Karatzas, Ernest Valveny, Josep Llads
2009ICDARText Segmentation in Colour Posters from the Spanish Civil War Era.Antonio Clavelli, Dimosthenis Karatzas
2008DASDetecting Gradients in Text Images Using the Hough Transform.Dimosthenis Karatzas
2008DASHistoSketch: A Semi-Automatic Annotation Tool for Archival Documents.Joan Mas, Jos A. Rodrguez, Dimosthenis Karatzas, Gemma Snchez, Josep Llads
2008ICPRSegmentation robust to the vignette effect for machine vision systems.Dimosthenis Karatzas, Maral Rusiol, Jacobus Antens, Miquel Ferrer
2006DASGround Truth for Layout Analysis Performance Evaluation.Apostolos Antonacopoulos, Dimosthenis Karatzas, David Bridson
2005ICDARSemantics-Based Content Extraction in Typewritten Historical Documents.Apostolos Antonacopoulos, Dimosthenis Karatzas
2004DASA Complete Approach to the Conversion of Typewritten Historical Documents for Digital Archives.Apostolos Antonacopoulos, Dimosthenis Karatzas
2004DocEngThe lifecycle of a digital historical document: structure and content.Apostolos Antonacopoulos, Dimosthenis Karatzas, Henryk Krawczyk, Bogdan Wiszniewski
2004ICPRText Extraction from Web Images Based on A Split-and-Merge Segmentation Method Using Colour Perception.Dimosthenis Karatzas, Apostolos Antonacopoulos
2003ICDARICDAR 2003 Page Segmentation Competition.Apostolos Antonacopoulos, Basilios Gatos, Dimosthenis Karatzas
2003ICDARTwo Approaches for Text Segmentation in Web Images.Dimosthenis Karatzas, Apostolos Antonacopoulos
2002DASFuzzy Segmentation of Characters in Web Images Based on Human Colour Perception.Apostolos Antonacopoulos, Dimosthenis Karatzas