Mikel Artetxe
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
43
Venues
8
Active years
2015–2025
Best venue rank
A*
Where they publish
Papers
43 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ACL | Emergent Abilities of Large Language Models under Continued Pre-training for Language Adaptation. | Ahmed Elhady, Eneko Agirre, Mikel Artetxe |
| 2025 | ACL | WiCkeD: A Simple Method to Make Multiple Choice Benchmarks More Challenging. | Ahmed Elhady, Eneko Agirre, Mikel Artetxe |
| 2025 | EMNLP | BOUQuET : dataset, Benchmark and Open initiative for Universal Quality Evaluation in Translation. | Pierre Andrews, Mikel Artetxe, Mariano Coria Meglioli, Marta R. Costa-juss, Joe Chuang, David Dale, Mark Duppenthaler, Nathanial Paul Ekberg, Cynthia Gao, Daniel Edward Licht, Jean Maillard, Alexandre Mourachko, Christophe Ropers, Safiyyah Saleem, Eduardo Snchez, Ioannis Tsiamas, Arina Turkatenko, Albert Ventayol-Boada, Shireen Yates |
| 2025 | EMNLP | Instructing Large Language Models for Low-Resource Languages: A Systematic Study for Basque. | Oscar Sainz, Naiara Prez, Julen Etxaniz, Joseba Fernandez de Landa, Itziar Aldabe, Iker Garca-Ferrero, Aimar Zabala, Ekhi Azurmendi, German Rigau, Eneko Agirre, Mikel Artetxe, Aitor Soroa |
| 2024 | ACL | The Belebele Benchmark: a Parallel Reading Comprehension Dataset in 122 Language Variants. | Lucas Bandarkar, Davis Liang, Benjamin Muller, Mikel Artetxe, Satya Narayan Shukla, Donald Husa, Naman Goyal, Abhinandan Krishnan, Luke Zettlemoyer, Madian Khabsa |
| 2024 | ACL | Latxa: An Open Language Model and Evaluation Suite for Basque. | Julen Etxaniz, Oscar Sainz, Naiara Miguel, Itziar Aldabe, German Rigau, Eneko Agirre, Aitor Ormazabal, Mikel Artetxe, Aitor Soroa |
| 2024 | NAACL | Improving Factuality in Clinical Abstractive Multi-Document Summarization by Guided Continued Pre-training. | Ahmed Elhady, Khaled Mostafa Elsayed, Eneko Agirre, Mikel Artetxe |
| 2024 | NAACL | Do Multilingual Language Models Think Better in English? | Julen Etxaniz, Gorka Azkune, Aitor Soroa, Oier Lopez de Lacalle, Mikel Artetxe |
| 2023 | ACL | Mini-Model Adaptation: Efficiently Extending Pretrained Models to New Languages via Aligned Shallow Training. | Kelly Marchisio, Patrick S. H. Lewis, Yihong Chen, Mikel Artetxe |
| 2023 | ACL | On the Role of Parallel Data in Cross-lingual Transfer Learning. | Machel Reid, Mikel Artetxe |
| 2023 | ACL | Training Trajectories of Language Models Across Scales. | Mengzhou Xia, Mikel Artetxe, Chunting Zhou, Xi Victoria Lin, Ramakanth Pasunuru, Danqi Chen, Luke Zettlemoyer, Veselin Stoyanov |
| 2023 | EMNLP | Revisiting Machine Translation for Cross-lingual Classification. | Mikel Artetxe, Vedanuj Goswami, Shruti Bhosale, Angela Fan, Luke Zettlemoyer |
| 2023 | EMNLP | CombLM: Adapting Black-Box Language Models through Small Fine-Tuned Models. | Aitor Ormazabal, Mikel Artetxe, Eneko Agirre |
| 2022 | ACL | Principled Paraphrase Generation with Parallel Corpora. | Aitor Ormazabal, Mikel Artetxe, Aitor Soroa, Gorka Labaka, Eneko Agirre |
| 2022 | EMNLP | Does Corpus Quality Really Matter for Low-Resource Languages? | Mikel Artetxe, Itziar Aldabe, Rodrigo Agerri, Olatz Perez-de-Viaspre, Aitor Soroa |
| 2022 | EMNLP | Efficient Large Scale Language Modeling with Mixtures of Experts. | Mikel Artetxe, Shruti Bhosale, Naman Goyal, Todor Mihaylov, Myle Ott, Sam Shleifer, Xi Victoria Lin, Jingfei Du, Srinivasan Iyer, Ramakanth Pasunuru, Giridharan Anantharaman, Xian Li, Shuohui Chen, Halil Akin, Mandeep Baines, Louis Martin, Xing Zhou, Punit Singh Koura, Brian O'Horo, Jeffrey Wang, Luke Zettlemoyer, Mona T. Diab, Zornitsa Kozareva, Veselin Stoyanov |
| 2022 | EMNLP | On the Role of Bidirectionality in Language Model Pre-Training. | Mikel Artetxe, Jingfei Du, Naman Goyal, Luke Zettlemoyer, Veselin Stoyanov |
| 2022 | EMNLP | Multilingual Machine Translation with Hyper-Adapters. | Christos Baziotis, Mikel Artetxe, James Cross, Shruti Bhosale |
| 2022 | EMNLP | Don't Prompt, Search! Mining-based Zero-Shot Learning with Language Models. | Mozes van de Kar, Mengzhou Xia, Danqi Chen, Mikel Artetxe |
| 2022 | EMNLP | Few-shot Learning with Multilingual Generative Language Models. | Xi Victoria Lin, Todor Mihaylov, Mikel Artetxe, Tianlu Wang, Shuohui Chen, Daniel Simig, Myle Ott, Naman Goyal, Shruti Bhosale, Jingfei Du, Ramakanth Pasunuru, Sam Shleifer, Punit Singh Koura, Vishrav Chaudhary, Brian O'Horo, Jeff Wang, Luke Zettlemoyer, Zornitsa Kozareva, Mona T. Diab, Veselin Stoyanov, Xian Li |
| 2022 | EMNLP | Rethinking the Role of Demonstrations: What Makes In-Context Learning Work? | Sewon Min, Xinxi Lyu, Ari Holtzman, Mikel Artetxe, Mike Lewis, Hannaneh Hajishirzi, Luke Zettlemoyer |
| 2022 | EMNLP | PoeLM: A Meter- and Rhyme-Controllable Language Model for Unsupervised Poetry Generation. | Aitor Ormazabal, Mikel Artetxe, Manex Agirrezabal, Aitor Soroa, Eneko Agirre |
| 2022 | EMNLP | Prompting ELECTRA: Few-Shot Learning with Discriminative Pre-Trained Models. | Mengzhou Xia, Mikel Artetxe, Jingfei Du, Danqi Chen, Veselin Stoyanov |
| 2022 | NAACL | Lifting the Curse of Multilinguality by Pre-training Modular Transformers. | Jonas Pfeiffer, Naman Goyal, Xi Victoria Lin, Xian Li, James Cross, Sebastian Riedel, Mikel Artetxe |
| 2022 | NAACL | PARADISE: Exploiting Parallel Data for Multilingual Sequence-to-Sequence Pretraining. | Machel Reid, Mikel Artetxe |
| 2021 | ACL | Beyond Offline Mapping: Learning Cross-lingual Word Embeddings through Context Anchoring. | Aitor Ormazabal, Mikel Artetxe, Aitor Soroa, Gorka Labaka, Eneko Agirre |
| 2021 | EACL | Multilingual Machine Translation: Closing the Gap between Shared and Language-specific Encoder-Decoders. | Carlos Escolano, Marta R. Costa-juss, Jos A. R. Fonollosa, Mikel Artetxe |
| 2020 | ACL | On the Cross-lingual Transferability of Monolingual Representations. | Mikel Artetxe, Sebastian Ruder, Dani Yogatama |
| 2020 | ACL | A Call for More Rigor in Unsupervised Cross-lingual Learning. | Mikel Artetxe, Sebastian Ruder, Dani Yogatama, Gorka Labaka, Eneko Agirre |
| 2020 | ACL | Unsupervised Multilingual Sentence Embeddings for Parallel Corpus Mining. | Ivana Kvapilkov, Mikel Artetxe, Gorka Labaka, Eneko Agirre, Ondrej Bojar |
| 2020 | EMNLP | Translation Artifacts in Cross-lingual Transfer Learning. | Mikel Artetxe, Gorka Labaka, Eneko Agirre |
| 2019 | ACL | An Effective Approach to Unsupervised Machine Translation. | Mikel Artetxe, Gorka Labaka, Eneko Agirre |
| 2019 | ACL | Bilingual Lexicon Induction through Unsupervised Machine Translation. | Mikel Artetxe, Gorka Labaka, Eneko Agirre |
| 2019 | ACL | Margin-based Parallel Corpus Mining with Multilingual Sentence Embeddings. | Mikel Artetxe, Holger Schwenk |
| 2019 | ACL | Analyzing the Limitations of Cross-lingual Word Embedding Mappings. | Aitor Ormazabal, Mikel Artetxe, Gorka Labaka, Aitor Soroa, Eneko Agirre |
| 2018 | AAAI | Generalizing and Improving Bilingual Word Embedding Mappings with a Multi-Step Framework of Linear Transformations. | Mikel Artetxe, Gorka Labaka, Eneko Agirre |
| 2018 | ACL | A robust self-learning method for fully unsupervised cross-lingual mappings of word embeddings. | Mikel Artetxe, Gorka Labaka, Eneko Agirre |
| 2018 | CoNLL | Uncovering Divergent Linguistic Information in Word Embeddings with Lessons for Intrinsic and Extrinsic Evaluation. | Mikel Artetxe, Gorka Labaka, Iigo Lopez-Gazpio, Eneko Agirre |
| 2018 | EMNLP | Unsupervised Statistical Machine Translation. | Mikel Artetxe, Gorka Labaka, Eneko Agirre |
| 2018 | ICLR | Unsupervised Neural Machine Translation. | Mikel Artetxe, Gorka Labaka, Eneko Agirre, Kyunghyun Cho |
| 2017 | ACL | Learning bilingual word embeddings with (almost) no bilingual data. | Mikel Artetxe, Gorka Labaka, Eneko Agirre |
| 2016 | EMNLP | Learning principled bilingual mappings of word embeddings while preserving monolingual invariance. | Mikel Artetxe, Gorka Labaka, Eneko Agirre |
| 2015 | EAMT | Building hybrid machine translation systems by using an EBMT preprocessor to create partial translations. | Mikel Artetxe, Gorka Labaka, Kepa Sarasola |