| 2025 | ACL | Emergent Abilities of Large Language Models under Continued Pre-training for Language Adaptation. | Ahmed Elhady, Eneko Agirre, Mikel Artetxe |
| 2025 | ACL | WiCkeD: A Simple Method to Make Multiple Choice Benchmarks More Challenging. | Ahmed Elhady, Eneko Agirre, Mikel Artetxe |
| 2025 | ACL | GUIDEX: Guided Synthetic Data Generation for Zero-Shot Information Extraction. | Neil De La Fuente, Oscar Sainz, Iker Garca-Ferrero, Eneko Agirre |
| 2025 | ACL | EnerGIZAr: Leveraging GIZA++ for Effective Tokenizer Initialization. | Pranaydeep Singh, Eneko Agirre, Gorka Azkune, Orphe De Clercq, Els Lefever |
| 2025 | EMNLP | Instructing Large Language Models for Low-Resource Languages: A Systematic Study for Basque. | Oscar Sainz, Naiara Prez, Julen Etxaniz, Joseba Fernandez de Landa, Itziar Aldabe, Iker Garca-Ferrero, Aimar Zabala, Ekhi Azurmendi, German Rigau, Eneko Agirre, Mikel Artetxe, Aitor Soroa |
| 2024 | ACL | PixT3: Pixel-based Table-To-Text Generation. | Iigo Alonso, Eneko Agirre, Mirella Lapata |
| 2024 | ACL | Latxa: An Open Language Model and Evaluation Suite for Basque. | Julen Etxaniz, Oscar Sainz, Naiara Miguel, Itziar Aldabe, German Rigau, Eneko Agirre, Aitor Ormazabal, Mikel Artetxe, Aitor Soroa |
| 2024 | COLING | Event Extraction in Basque: Typologically Motivated Cross-Lingual Transfer-Learning Analysis. | Mikel Zubillaga, Oscar Sainz, Ainara Estarrona, Oier Lopez de Lacalle, Eneko Agirre |
| 2024 | ICLR | GoLLIE: Annotation Guidelines improve Zero-Shot Information-Extraction. | Oscar Sainz, Iker Garca-Ferrero, Rodrigo Agerri, Oier Lopez de Lacalle, German Rigau, Eneko Agirre |
| 2024 | NAACL | Improving Factuality in Clinical Abstractive Multi-Document Summarization by Guided Continued Pre-training. | Ahmed Elhady, Khaled Mostafa Elsayed, Eneko Agirre, Mikel Artetxe |
| 2023 | EMNLP | CombLM: Adapting Black-Box Language Models through Small Fine-Tuned Models. | Aitor Ormazabal, Mikel Artetxe, Eneko Agirre |
| 2023 | EMNLP | NLP Evaluation in trouble: On the Need to Measure LLM Data Contamination for each Benchmark. | Oscar Sainz, Jon Ander Campos, Iker Garca-Ferrero, Julen Etxaniz, Oier Lopez de Lacalle, Eneko Agirre |
| 2022 | ACL | Principled Paraphrase Generation with Parallel Corpora. | Aitor Ormazabal, Mikel Artetxe, Aitor Soroa, Gorka Labaka, Eneko Agirre |
| 2022 | EMNLP | PoeLM: A Meter- and Rhyme-Controllable Language Model for Unsupervised Poetry Generation. | Aitor Ormazabal, Mikel Artetxe, Manex Agirrezabal, Aitor Soroa, Eneko Agirre |
| 2022 | NAACL | Textual Entailment for Event Argument Extraction: Zero- and Few-Shot with Multi-Source Learning. | Oscar Sainz, Itziar Gonzalez-Dios, Oier Lopez de Lacalle, Bonan Min, Eneko Agirre |
| 2022 | SIGIR | Few-shot Information Extraction is Here: Pre-train, Prompt and Entail. | Eneko Agirre |
| 2021 | ACL | Beyond Offline Mapping: Learning Cross-lingual Word Embeddings through Context Anchoring. | Aitor Ormazabal, Mikel Artetxe, Aitor Soroa, Gorka Labaka, Eneko Agirre |
| 2021 | EMNLP | Label Verbalization and Entailment for Effective Zero and Few-Shot Relation Extraction. | Oscar Sainz, Oier Lopez de Lacalle, Gorka Labaka, Ander Barrena, Eneko Agirre |
| 2020 | ACL | A Call for More Rigor in Unsupervised Cross-lingual Learning. | Mikel Artetxe, Sebastian Ruder, Dani Yogatama, Gorka Labaka, Eneko Agirre |
| 2020 | ACL | DoQA - Accessing Domain-Specific FAQs via Conversational QA. | Jon Ander Campos, Arantxa Otegi, Aitor Soroa, Jan Deriu, Mark Cieliebak, Eneko Agirre |
| 2020 | ACL | A Methodology for Creating Question Answering Corpora Using Inverse Data Annotation. | Jan Deriu, Katsiaryna Mlynchyk, Philippe Schlpfer, lvaro Rodrigo, Dirk Von Gruenigen, Nicolas Kaiser, Kurt Stockinger, Eneko Agirre, Mark Cieliebak |
| 2020 | ACL | Unsupervised Multilingual Sentence Embeddings for Parallel Corpus Mining. | Ivana Kvapilkov, Mikel Artetxe, Gorka Labaka, Eneko Agirre, Ondrej Bojar |
| 2020 | COLING | Improving Conversational Question Answering Systems after Deployment using Feedback-Weighted Learning. | Jon Ander Campos, Kyunghyun Cho, Arantxa Otegi, Aitor Soroa, Eneko Agirre, Gorka Azkune |
| 2020 | ECAI | Evaluating Multimodal Representations on Visual Semantic Textual Similarity. | Oier Lopez de Lacalle, Ander Salaberria, Aitor Soroa, Gorka Azkune, Eneko Agirre |
| 2020 | EMNLP | Translation Artifacts in Cross-lingual Transfer Learning. | Mikel Artetxe, Gorka Labaka, Eneko Agirre |
| 2020 | EMNLP | Spot The Bot: A Robust and Efficient Framework for the Evaluation of Conversational Dialogue Systems. | Jan Deriu, Don Tuggener, Pius von Dniken, Jon Ander Campos, lvaro Rodrigo, Thiziri Belkacem, Aitor Soroa, Eneko Agirre, Mark Cieliebak |
| 2020 | EMNLP | Automatic Evaluation vs. User Preference in Neural Textual QuestionAnswering over COVID-19 Scientific Literature. | Arantxa Otegi, Jon Ander Campos, Gorka Azkune, Aitor Soroa, Eneko Agirre |
| 2020 | LREC | Give your Text Representation Models some Love: the Case for Basque. | Rodrigo Agerri, Iaki San Vicente, Jon Ander Campos, Ander Barrena, Xabier Saralegi, Aitor Soroa, Eneko Agirre |
| 2020 | LREC | Conversational Question Answering in Low Resource Scenarios: A Dataset and Case Study for Basque. | Arantxa Otegi, Aitor Gonzalez-Agirre, Jon Ander Campos, Aitor Soroa, Eneko Agirre |
| 2019 | ACL | An Effective Approach to Unsupervised Machine Translation. | Mikel Artetxe, Gorka Labaka, Eneko Agirre |
| 2019 | ACL | Bilingual Lexicon Induction through Unsupervised Machine Translation. | Mikel Artetxe, Gorka Labaka, Eneko Agirre |
| 2019 | ACL | Analyzing the Limitations of Cross-lingual Word Embedding Mappings. | Aitor Ormazabal, Mikel Artetxe, Gorka Labaka, Aitor Soroa, Eneko Agirre |
| 2019 | ACL | Probing for Semantic Classes: Diagnosing the Meaning Content of Word Embeddings. | Yadollah Yaghoobzadeh, Katharina Kann, Timothy J. Hazen, Eneko Agirre, Hinrich Schtze |
| 2018 | AAAI | Generalizing and Improving Bilingual Word Embedding Mappings with a Multi-Step Framework of Linear Transformations. | Mikel Artetxe, Gorka Labaka, Eneko Agirre |
| 2018 | ACL | A robust self-learning method for fully unsupervised cross-lingual mappings of word embeddings. | Mikel Artetxe, Gorka Labaka, Eneko Agirre |
| 2018 | CoNLL | Uncovering Divergent Linguistic Information in Word Embeddings with Lessons for Intrinsic and Extrinsic Evaluation. | Mikel Artetxe, Gorka Labaka, Iigo Lopez-Gazpio, Eneko Agirre |
| 2018 | CoNLL | Learning Text Representations for 500K Classification Tasks on Named Entity Disambiguation. | Ander Barrena, Aitor Soroa, Eneko Agirre |
| 2018 | EMNLP | Unsupervised Statistical Machine Translation. | Mikel Artetxe, Gorka Labaka, Eneko Agirre |
| 2018 | ICLR | Unsupervised Neural Machine Translation. | Mikel Artetxe, Gorka Labaka, Eneko Agirre, Kyunghyun Cho |
| 2017 | ACL | Learning bilingual word embeddings with (almost) no bilingual data. | Mikel Artetxe, Gorka Labaka, Eneko Agirre |
| 2016 | AAAI | Single or Multiple? Combining Word Representations Independently Learned from Text and WordNet. | Josu Goikoetxea, Eneko Agirre, Aitor Soroa |
| 2016 | ACL | Alleviating Poor Context with Background Knowledge for Named Entity Disambiguation. | Ander Barrena, Aitor Soroa, Eneko Agirre |
| 2016 | COLING | Improving Translation Selection with Supersenses. | Haiqing Tang, Deyi Xiong, Oier Lopez de Lacalle, Eneko Agirre |
| 2016 | EMNLP | Learning principled bilingual mappings of word embeddings while preserving monolingual invariance. | Mikel Artetxe, Gorka Labaka, Eneko Agirre |
| 2016 | LREC | A comparison of Named-Entity Disambiguation and Word Sense Disambiguation. | Angel X. Chang, Valentin I. Spitkovsky, Christopher D. Manning, Eneko Agirre |
| 2016 | LREC | Word Sense-Aware Machine Translation: Including Senses as Contextual Features for Improved Translation Models. | Steven Neale, Lus Gomes, Eneko Agirre, Oier Lopez de Lacalle, Antnio Branco |
| 2016 | LREC | QTLeap WSD/NED Corpora: Semantic Annotation of Parallel Corpora in Six Languages. | Arantxa Otegi, Nora Aranberri, Antnio Branco, Jan Hajic, Martin Popel, Kiril Ivanov Simov, Eneko Agirre, Petya Osenova, Rita Valadas Pereira, Joo Ricardo Silva, Steven Neale |
| 2016 | LREC | Addressing the MFS Bias in WSD systems. | Marten Postma, Rubn Izquierdo, Eneko Agirre, German Rigau, Piek Vossen |
| 2016 | LREC | Evaluating Translation Quality and CLIR Performance of Query Sessions. | Xabier Saralegi, Eneko Agirre, Iaki Alegria |
| 2015 | ACL | Improving distant supervision using inference learning. | Roland Roller, Eneko Agirre, Aitor Soroa, Mark Stevenson |
| 2015 | EMNLP | Predicting word sense annotation agreement. | Hctor Martnez Alonso, Anders Johannsen, Oier Lopez de Lacalle, Eneko Agirre |
| 2015 | NAACL | Random Walks and Neural Network Language Models on Knowledge Bases. | Josu Goikoetxea, Aitor Soroa, Eneko Agirre |
| 2015 | NAACL | Diamonds in the Rough: Event Extraction from Imperfect Microblog Data. | Ander Intxaurrondo, Eneko Agirre, Oier Lopez de Lacalle, Mihai Surdeanu |
| 2014 | ACL | On WordNet Semantic Classes and Dependency Parsing. | Kepa Bengoetxea, Eneko Agirre, Joakim Nivre, Yue Zhang, Koldo Gojenola |
| 2014 | COLING | "One Entity per Discourse" and "One Entity per Collocation" Improve Named-Entity Disambiguation. | Ander Barrena, Eneko Agirre, Bernardo Cabaleiro, Anselmo Peas, Aitor Soroa |
| 2014 | SIGIR | UBC entity recognition and disambiguation at ERD 2014. | Ander Barrena, Eneko Agirre, Aitor Soroa |
| 2013 | ACL | PATHS: A System for Accessing Cultural Heritage Collections. | Eneko Agirre, Nikolaos Aletras, Paul D. Clough, Samuel Fernando, Paula Goodale, Mark M. Hall, Aitor Soroa, Mark Stevenson |
| 2013 | SIGIR | Information seeking in digital cultural heritage with PATHS. | Mark M. Hall, Paul D. Clough, Samuel Fernando, Paula Goodale, Mark Stevenson, Eneko Agirre, Arantxa Otegi, Aitor Soroa, Kate Fernie, Jillian Griffiths, Runar Bergheim |
| 2012 | COLING | Contribution of Complex Lexical Information to Solve Syntactic Ambiguity in Basque. | Aitziber Atutxa, Eneko Agirre, Kepa Sarasola |
| 2012 | COLING | Comparing Taxonomies for Organising Collections of Documents. | Samuel Fernando, Mark M. Hall, Eneko Agirre, Aitor Soroa, Paul D. Clough, Mark Stevenson |
| 2012 | LREC | Matching Cultural Heritage items to Wikipedia. | Eneko Agirre, Ander Barrena, Oier Lopez de Lacalle, Aitor Soroa, Samuel Fernando, Mark Stevenson |
| 2011 | ACL | Improving Dependency Parsing with Semantic Classes. | Eneko Agirre, Kepa Bengoetxea, Koldo Gojenola, Joakim Nivre |
| 2011 | CIKM | Two birds with one stone: learning semantic models for text categorization and word sense disambiguation. | Roberto Navigli, Stefano Faralli, Aitor Soroa, Oier Lopez de Lacalle, Eneko Agirre |
| 2011 | IJCNLP | Query Expansion for IR using Knowledge-Based Relatedness. | Arantxa Otegi, Xabier Arregi, Eneko Agirre |
| 2010 | COLING | Document Expansion Based on WordNet for Robust IR. | Eneko Agirre, Xabier Arregi, Arantxa Otegi |
| 2010 | COLING | Plagiarism Detection across Distant Language Pairs. | Alberto Barrn-Cedeo, Paolo Rosso, Eneko Agirre, Gorka Labaka |
| 2010 | LREC | Exploring Knowledge Bases for Similarity. | Eneko Agirre, Montse Cuadros, German Rigau, Aitor Soroa |
| 2010 | NAACL | Improving Semantic Role Classification with Selectional Preferences. | Beat Zapirain, Eneko Agirre, Llus Mrquez, Mihai Surdeanu |
| 2009 | ACL | Generalizing over Lexical Features: Selectional Preferences for Semantic Role Classification. | Beat Zapirain, Eneko Agirre, Llus Mrquez |
| 2009 | EACL | Supervised Domain Adaption for WSD. | Eneko Agirre, Oier Lopez de Lacalle |
| 2009 | EACL | Personalizing PageRank for Word Sense Disambiguation. | Eneko Agirre, Aitor Soroa |
| 2009 | EAMT | Use of Rich Linguistic Information to Translate Prepositions and Grammar Cases to Basque. | Eneko Agirre, Aitziber Atutxa, Gorka Labaka, Mikel Lersundi, Aingeru Mayor, Kepa Sarasola |
| 2009 | IJCAI | Knowledge-Based WSD and Specific Domains: Performing Better than Generic Supervised WSD. | Eneko Agirre, Oier Lopez de Lacalle, Aitor Soroa |
| 2009 | NAACL | A Study on Similarity and Relatedness Using Distributional and WordNet-based Approaches. | Eneko Agirre, Enrique Alfonseca, Keith B. Hall, Jana Kravalova, Marius Pasca, Aitor Soroa |
| 2009 | NAACL | SemEval-2010 Task 17: All-words Word Sense Disambiguation on a Specific Domain. | Eneko Agirre, Oier Lopez de Lacalle, Christiane Fellbaum, Andrea Marchetti, Antonio Toral, Piek Vossen |
| 2009 | RANLP | A Study on Linking Wikipedia Categories to Wordnet Synsets using Text Similarity. | Antonio Toral, scar Ferrndez, Eneko Agirre, Rafael Muoz |
| 2008 | ACL | Improving Parsing and PP Attachment Performance with Sense Information. | Eneko Agirre, Timothy Baldwin, David Martnez |
| 2008 | ACL | Robustness and Generalization of Role Sets: PropBank vs. VerbNet. | Beat Zapirain, Eneko Agirre, Llus Mrquez |
| 2008 | CICLING | A Preliminary Study on the Robustness and Generalization of Role Sets for Semantic Role Labeling. | Beat Zapirain, Eneko Agirre, Llus Mrquez |
| 2008 | COLING | On Robustness and Domain Adaptation using SVD for Word Sense Disambiguation. | Eneko Agirre, Oier Lopez de Lacalle |
| 2008 | LREC | Using the Multilingual Central Repository for Graph-Based Word Sense Disambiguation. | Eneko Agirre, Aitor Soroa |
| 2008 | LREC | WNTERM: Enriching the MCR with a Terminological Dictionary. | Eli Pociello, Antton Gurrutxaga, Eneko Agirre, Izaskun Aldezabal, German Rigau |
| 2008 | LREC | KYOTO: a System for Mining, Structuring and Distributing Knowledge across Languages and Cultures. | Piek Vossen, Eneko Agirre, Nicoletta Calzolari, Christiane Fellbaum, Shu-Kai Hsieh, Chu-Ren Huang, Hitoshi Isahara, Kyoko Kanzaki, Andrea Marchetti, Monica Monachini, Federico Neri, Remo Raffaelli, German Rigau, Maurizio Tesconi, Joop VanGent |
| 2006 | EMNLP | Two graph-based algorithms for state-of-the-art WSD. | Eneko Agirre, David Martnez, Oier Lopez de Lacalle, Aitor Soroa |
| 2006 | LREC | A methodology for the joint development of the Basque WordNet and Semcor. | Eneko Agirre, Izaskun Aldezabal, Jone Etxeberria, Eli Izagirre, Karmele Mendizabal, Eli Pociello, Mikel Quintian |
| 2006 | LREC | A Preliminary Study for Building the Basque PropBank. | Eneko Agirre, Izaskun Aldezabal, Jone Etxeberria, Eli Pociello |
| 2004 | EMNLP | Unsupervised WSD based on Automatically Retrieved Examples: The Importance of Bias. | Eneko Agirre, David Martnez |
| 2004 | LREC | Exploring Portability of Syntactic Information from English to Basque. | Eneko Agirre, Aitziber Atutxa, Koldo Gojenola, Kepa Sarasola |
| 2004 | LREC | Publicly Available Topic Signatures for all WordNet Nominal Senses. | Eneko Agirre, Oier Lopez de Lacalle |
| 2004 | LREC | Cross-Language Acquisition of Semantic Models for Verbal Predicates. | Jordi Atserias, Bernardo Magnini, Octavian Popescu, Eneko Agirre, Aitziber Atutxa, German Rigau, John Carroll, Rob Koeling |
| 2004 | LREC | The Effect of Bias on an Automatically-built Word Sense Corpus. | David Martnez, Eneko Agirre |
| 2003 | RANLP | Clustering WordNet word senses. | Eneko Agirre, Oier Lopez de Lacalle |
| 2002 | COLING | Syntactic Features for High Precision Word Sense Disambiguation. | David Martnez, Eneko Agirre, Llus Mrquez |
| 2002 | COLING | MEANING: a Roadmap to Knowledge Technologies. | German Rigau, Bernardo Magnini, Eneko Agirre, Piek Vossen, John Carroll |
| 2001 | CoNLL | Learning class-to-class selectional preferences. | Eneko Agirre, David Martnez |
| 2000 | COLING | A word-grammar based morphological analyzer for agglutinative languages. | Itziar Aduriz, Eneko Agirre, Izaskun Aldezabal, Iaki Alegria, Xabier Arregi, Jose Maria Arriola, Xabier Artola, Koldo Gojenola Galletebeitia, Montse Maritxalar, Kepa Sarasola, Miriam Urkia |
| 2000 | COLING | Exploring Automatic Word Sense Disambiguation with Decision Lists and the Web. | Eneko Agirre, David Martnez |
| 2000 | ECAI | Enriching very large ontologies using the WWW. | Eneko Agirre, Olatz Ansa, Eduard H. Hovy, David Martnez |
| 2000 | EMNLP | One Sense per Collocation and Genre/Topic Variations. | David Martnez, Eneko Agirre |
| 2000 | LREC | A Word-level Morphosyntactic Analyzer for Basque. | Itziar Aduriz, Eneko Agirre, Izaskun Aldezabal, Xabier Arregi, Jose Maria Arriola, Xabier Artola, Koldo Gojenola, A. Maritxalar, Kepa Sarasola, Miriam Urkia |
| 1998 | ACL | Towards a Single Proposal in Spelling Correction. | Eneko Agirre, Koldo Gojenola Galletebeitia, Kepa Sarasola, Atro Voutilainen |
| 1998 | ACL | Building Accurate Semantic Taxonomies from Monolingual MRDs. | German Rigau, Eneko Agirre |
| 1997 | ACL | Combining Unsupervised Lexical Knowledge Methods for Word Sense Disambiguation. | German Rigau, Jordi Atserias, Eneko Agirre |
| 1996 | COLING | Word Sense Disambiguation using Conceptual Density. | Eneko Agirre, German Rigau |
| 1995 | NLDB | Different Issues in the Design of a General-Purpose Lexical Database for Basque. | Eneko Agirre, Xabier Arregi, Jose Maria Arriola, Xabier Artola, Arantza Daz de Ilarraza Snchez, J. M. Insausti, Kepa Sarasola |
| 1994 | COLING | Lexical, Knowledge Representation In An Intelligent Dictionary Help System. | Eneko Agirre, Xabier Arregi, Xabier Artola, Arantza Daz de Ilarraza Snchez, Kepa Sarasola |
| 1993 | EACL | A Morphological Analysis Based Method for Spelling Correction. | Itziar Aduriz, Eneko Agirre, Iaki Alegria, Xabier Arregi, Jose Maria Arriola, Xabier Artola, Arantza Daz de Ilarraza Snchez, Nerea Ezeiza, Montse Maritxalar, Kepa Sarasola, Miriam Urkia |