| 2026 | LREC | Universal NER v2: Towards a Massively Multilingual Named Entity Recognition Benchmark. | Terra Blevins, Stephen Mayhew, Marek Suppa, Hila Gonen, Shachar Mirkin, Vasile Pais, Kaja Dobrovoljc Zor, Voula Giouli, Jun Kevin, Eugene Jang, Eungseo Kim, Jeongyeon Seo, Xenophon Gialis, Yuval Pinter |
| 2025 | EMNLP | Dementia Through Different Eyes: Explainable Modeling of Human and LLM Perceptions for Early Awareness. | Lotem Peled-Cohen, Maya Zadok, Nitay Calderon, Hila Gonen, Roi Reichart |
| 2025 | EMNLP | MULTIGUARD: An Efficient Approach for AI Safety Moderation Across Languages and Modalities. | Sahil Verma, Keegan Hines, Jeff A. Bilmes, Charlotte Siska, Luke Zettlemoyer, Hila Gonen, Chandan Singh |
| 2025 | NAACL | Does Liking Yellow Imply Driving a School Bus? Semantic Leakage in Language Models. | Hila Gonen, Terra Blevins, Alisa Liu, Luke Zettlemoyer, Noah A. Smith |
| 2024 | ACL | MYTE: Morphology-Driven Byte Encoding for Better and Fairer Multilingual Language Modeling. | Tomasz Limisiewicz, Terra Blevins, Hila Gonen, Orevaoghene Ahia, Luke Zettlemoyer |
| 2024 | EMNLP | Voices Unheard: NLP Resources and Models for Yorb Regional Dialects. | Orevaoghene Ahia, Anuoluwapo Aremu, Diana Abagyan, Hila Gonen, David Ifeoluwa Adelani, Daud Abolade, Noah A. Smith, Yulia Tsvetkov |
| 2024 | EMNLP | Breaking the Curse of Multilinguality with Cross-lingual Expert Language Models. | Terra Blevins, Tomasz Limisiewicz, Suchin Gururangan, Margaret Li, Hila Gonen, Noah A. Smith, Luke Zettlemoyer |
| 2024 | NAACL | Universal NER: A Gold-Standard Multilingual Named Entity Recognition Benchmark. | Stephen Mayhew, Terra Blevins, Shuheng Liu, Marek Suppa, Hila Gonen, Joseph Marvin Imperial, Brje Karlsson, Peiqin Lin, Nikola Ljubesic, Lester James V. Miranda, Barbara Plank, Arij Riabi, Yuval Pinter |
| 2024 | NAACL | BUFFET: Benchmarking Large Language Models for Few-shot Cross-lingual Transfer. | Akari Asai, Sneha Kudugunta, Xinyan Yu, Terra Blevins, Hila Gonen, Machel Reid, Yulia Tsvetkov, Sebastian Ruder, Hannaneh Hajishirzi |
| 2023 | ACL | Prompting Language Models for Linguistic Structure. | Terra Blevins, Hila Gonen, Luke Zettlemoyer |
| 2023 | EMNLP | Do All Languages Cost the Same? Tokenization in the Era of Commercial Language Models. | Orevaoghene Ahia, Sachin Kumar, Hila Gonen, Jungo Kasai, David R. Mortensen, Noah A. Smith, Yulia Tsvetkov |
| 2023 | EMNLP | Demystifying Prompts in Language Models via Perplexity Estimation. | Hila Gonen, Srini Iyer, Terra Blevins, Noah A. Smith, Luke Zettlemoyer |
| 2023 | EMNLP | That was the last straw, we need more: Are Translation Systems Sensitive to Disambiguating Context? | Jaechan Lee, Alisa Liu, Orevaoghene Ahia, Hila Gonen, Noah A. Smith |
| 2023 | EMNLP | XLM-V: Overcoming the Vocabulary Bottleneck in Multilingual Masked Language Models. | Davis Liang, Hila Gonen, Yuning Mao, Rui Hou, Naman Goyal, Marjan Ghazvininejad, Luke Zettlemoyer, Madian Khabsa |
| 2023 | EMNLP | Toward Human Readable Prompt Tuning: Kubrick's The Shining is a good movie, and a good prompt too? | Weijia Shi, Xiaochuang Han, Hila Gonen, Ari Holtzman, Yulia Tsvetkov, Luke Zettlemoyer |
| 2022 | EMNLP | Analyzing the Mono- and Cross-Lingual Pretraining Dynamics of Multilingual Language Models. | Terra Blevins, Hila Gonen, Luke Zettlemoyer |
| 2022 | EMNLP | McPhraSy: Multi-Context Phrase Similarity and Clustering. | Amir David Nissan Cohen, Hila Gonen, Ori Shapira, Ran Levy, Yoav Goldberg |
| 2021 | NAACL | Identifying Helpful Sentences in Product Reviews. | Iftah Gamzu, Hila Gonen, Gilad Kutiel, Ran Levy, Eugene Agichtein |
| 2020 | ACL | Simple, Interpretable and Stable Method for Detecting Words with Usage Change across Corpora. | Hila Gonen, Ganesh Jawahar, Djam Seddah, Yoav Goldberg |
| 2020 | ACL | Null It Out: Guarding Protected Attributes by Iterative Nullspace Projection. | Shauli Ravfogel, Yanai Elazar, Hila Gonen, Michael Twiton, Yoav Goldberg |
| 2020 | COLING | Pick a Fight or Bite your Tongue: Investigation of Gender Differences in Idiomatic Language Usage. | Ella Rabinovich, Hila Gonen, Suzanne Stevenson |
| 2020 | EMNLP | Automatically Identifying Gender Issues in Machine Translation using Perturbations. | Hila Gonen, Kellie Webster |
| 2019 | CoNLL | How Does Grammatical Gender Affect Noun Representations in Gender-Marking Languages? | Hila Gonen, Yova Kementchedjhieva, Yoav Goldberg |
| 2019 | EMNLP | Language Modeling for Code-Switching: Evaluation, Integration of Monolingual Data, and Discriminative Training. | Hila Gonen, Yoav Goldberg |
| 2019 | EMNLP | It's All in the Name: Mitigating Gender Bias with Name-Based Counterfactual Data Substitution. | Rowan Hall Maudslay, Hila Gonen, Ryan Cotterell, Simone Teufel |
| 2019 | NAACL | Lipstick on a Pig: Debiasing Methods Cover up Systematic Gender Biases in Word Embeddings But do not Remove Them. | Hila Gonen, Yoav Goldberg |
| 2016 | COLING | Semi Supervised Preposition-Sense Disambiguation using Multilingual Data. | Hila Gonen, Yoav Goldberg |