| 2025 | EMNLP | FSTs vs ICL: Generalisation in LLMs for an under-resourced language. | Ximena Gutierrez-Vasques, Mikel Segura Elizalde, Victor Mijangos |
| 2024 | NAACL | A Measure for Transparent Comparison of Linguistic Diversity in Multilingual NLP Data Sets. | Tanja Samardzic, Ximena Gutierrez-Vasques, Christian Bentz, Steven Moran, Olga Pelloni |
| 2022 | CoNLL | On Language Spaces, Scales and Cross-Lingual Transfer of UD Parsers. | Tanja Samardzic, Ximena Gutierrez-Vasques, Rob van der Goot, Max Mller-Eberstein, Olga Pelloni, Barbara Plank |
| 2022 | LREC | TeDDi Sample: Text Data Diversity Sample for Language Comparison and Multilingual NLP. | Steven Moran, Christian Bentz, Ximena Gutierrez-Vasques, Olga Pelloni, Tanja Samardzic |
| 2021 | EACL | From characters to words: the turning point of BPE merges. | Ximena Gutierrez-Vasques, Christian Bentz, Olga Sozinova, Tanja Samardzic |
| 2021 | EACL | Interpretability for Morphological Inflection: from Character-level Predictions to Subword-level Rules. | Tatyana Ruzsics, Olga Sozinova, Ximena Gutierrez-Vasques, Tanja Samardzic |
| 2018 | COLING | Challenges of language technologies for the indigenous languages of the Americas. | Manuel Mager, Ximena Gutierrez-Vasques, Gerardo Sierra, Ivn V. Meza-Ruz |
| 2016 | LREC | Axolotl: a Web Accessible Parallel Corpus for Spanish-Nahuatl. | Ximena Gutierrez-Vasques, Gerardo Sierra, Isaac Hernandez Pompa |
| 2015 | NAACL | Bilingual lexicon extraction for a distant language pair using a small parallel corpus. | Ximena Gutierrez-Vasques |