| 2026 | LREC | From Semi-Digital Edition to Historical NLP Resource: Constructing and Annotating Historical Multilingual Parallel Text Collections on the TEITOK Platform. | Maarten Janssen, Anna Jouravel, Piroska Lendvai |
| 2025 | RANLP | Alignment of Historical Manuscript Transcriptions and Translations. | Maarten Janssen, Piroska Lendvai, Anna Jouravel |
| 2024 | COLING | UDMorph: Morphosyntactically Tagged UD Corpora. | Maarten Janssen |
| 2016 | LREC | TEITOK: Text-Faithful Annotated Corpora. | Maarten Janssen |
| 2016 | LREC | The COPLE2 corpus: a learner corpus for Portuguese. | Amlia Mendes, Sandra Antunes, Maarten Janssen, Anabela Gonalves |
| 2012 | Interspeech | A Rule Based Pronunciation Generator and Regional Accent Databank for Portuguese. | Simone Ashby, Slvia Barbosa, Silvia Brando, Jos Pedro Ferreira, Maarten Janssen, Catarina Silva, Mrio Eduardo Viaro |
| 2012 | LREC | The Common Orthographic Vocabulary of the Portuguese Language: a set of open lexical resources for a pluricentric language. | Jos Pedro Ferreira, Maarten Janssen, Gladis Barcellos de Oliveira, Margarita Correia, Gilvan Mller de Oliveira |
| 2012 | LREC | NeoTag: a POS Tagger for Grammatical Neologism Detection. | Maarten Janssen |
| 2010 | LREC | Combining Resources: Taxonomy Extraction from Multiple Dictionaries. | Rogelio Nazar, Maarten Janssen |
| 2008 | LREC | Spock - a Spoken Corpus Client. | Maarten Janssen, Tiago Freitas |