Adina Williams
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
43
Venues
8
Active years
2018–2026
Best venue rank
A*
Where they publish
Papers
43 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | Calibrating LLM Judges: Linear Probes for Fast and Reliable Uncertainty Estimation. | Bhaktipriya Radharapu, Eshika Saxena, Kenneth Li, Chenxi Whitehouse, Adina Williams, Nicola Cancedda |
| 2025 | ACL | Domain Regeneration: How well do LLMs match syntactic properties of text domains? | Da Ju, Hagen Blix, Adina Williams |
| 2025 | ACL | Arbiters of Ambivalence: Challenges of using LLMs in No-Consensus tasks. | Bhaktipriya Radharapu, Manon Revel, Megan Ung, Sebastian Ruder, Adina Williams |
| 2025 | NAACL | On the Role of Speech Data in Reducing Toxicity Detection Bias. | Samuel J. Bell, Mariano Coria Meglioli, Megan Richards, Eduardo Snchez, Christophe Ropers, Skyler Wang, Adina Williams, Levent Sagun, Marta R. Costa-juss |
| 2025 | NAACL | Improving Model Evaluation using SMART Filtering of Benchmark Datasets. | Vipul Gupta, Candace Ross, David Pantoja, Rebecca J. Passonneau, Megan Ung, Adina Williams |
| 2024 | ACL | Are Female Carpenters like Blue Bananas? A Corpus Investigation of Occupation Gender Typicality. | Da Ju, Karen Ullrich, Adina Williams |
| 2024 | CogSci | Insights from the first BabyLM Challenge: Training sample-efficient language models on a developmentally plausible corpus. | Alex Warstadt, Aaron Mueller, Leshem Choshen, Ethan Gotlieb Wilcox, Chengxu Zhuang, Adina Williams, Ryan Cotterell, Tal Linzen |
| 2024 | CogSci | Compositional learning of functions in humans and machines. | Yanli Zhou, Brenden M. Lake, Adina Williams |
| 2024 | EMNLP | EmphAssess : a Prosodic Benchmark on Assessing Emphasis Transfer in Speech-to-Speech Models. | Maureen de Seyssel, Antony D'Avirro, Adina Williams, Emmanuel Dupoux |
| 2023 | AAAI | A Latent-Variable Model for Intrinsic Probing. | Karolina Stanczak, Lucas Torroba Hennigen, Adina Williams, Ryan Cotterell, Isabelle Augenstein |
| 2023 | ACL | Language model acceptability judgements are not always robust to context. | Koustuv Sinha, Jon Gauthier, Aaron Mueller, Kanishka Misra, Keren Fuentes, Roger Levy, Adina Williams |
| 2023 | CoNLL | The Validity of Evaluation Results: Assessing Concurrence Across Compositionality Benchmarks. | Kaiser Sun, Adina Williams, Dieuwke Hupkes |
| 2023 | EMNLP | ROBBIE: Robust Bias Evaluation of Large Generative Language Models. | David Esiobu, Xiaoqing Ellen Tan, Saghar Hosseini, Megan Ung, Yuchen Zhang, Jude Fernandes, Jane Dwivedi-Yu, Eleonora Presani, Adina Williams, Eric Michael Smith |
| 2023 | EMNLP | Robustness of Named-Entity Replacements for In-Context Learning. | Saeed Goodarzi, Nikhil Kagita, Dennis Minn, Shufan Wang, Roberto Dess, Shubham Toshniwal, Adina Williams, Jack Lanchantin, Koustuv Sinha |
| 2022 | ACL | Investigating Failures of Automatic Translationin the Case of Unambiguous Gender. | Adi Renduchintala, Adina Williams |
| 2022 | ACL | Dynatask: A Framework for Creating Dynamic AI Benchmark Tasks. | Tristan Thrush, Kushal Tirumala, Anmol Gupta, Max Bartolo, Pedro Rodriguez, Tariq Kane, William Gaviria Rojas, Peter Mattson, Adina Williams, Douwe Kiela |
| 2022 | ACL | Analyzing Dynamic Adversarial Training Data in the Limit. | Eric Wallace, Adina Williams, Robin Jia, Douwe Kiela |
| 2022 | CogSci | Evaluating locality in NMT models. | Itay Itzhak, Koustuv Sinha, Brenden M. Lake, Adina Williams, Dieuwke Hupkes |
| 2022 | COLING | Benchmarking Compositionality with Formal Languages. | Josef Valvoda, Naomi Saphra, Jonathan Rawski, Adina Williams, Ryan Cotterell |
| 2022 | CVPR | Winoground: Probing Vision and Language Models for Visio-Linguistic Compositionality. | Tristan Thrush, Ryan Jiang, Max Bartolo, Amanpreet Singh, Adina Williams, Douwe Kiela, Candace Ross |
| 2022 | EMNLP | Perturbation Augmentation for Fairer NLP. | Rebecca Qian, Candace Ross, Jude Fernandes, Eric Michael Smith, Douwe Kiela, Adina Williams |
| 2022 | EMNLP | The Curious Case of Absolute Position Embeddings. | Koustuv Sinha, Amirhossein Kazemnejad, Siva Reddy, Joelle Pineau, Dieuwke Hupkes, Adina Williams |
| 2022 | EMNLP | "I'm sorry to hear that": Finding New Biases in Language Models with a Holistic Descriptor Dataset. | Eric Michael Smith, Melissa Hall, Melanie Kambadur, Eleonora Presani, Adina Williams |
| 2022 | NAACL | On the Machine Learning of Ethical Judgments from Natural Language. | Zeerak Talat, Hagen Blix, Josef Valvoda, Maya Indira Ganesh, Ryan Cotterell, Adina Williams |
| 2021 | ACL | UnNatural Language Inference. | Koustuv Sinha, Prasanna Parthasarathi, Joelle Pineau, Adina Williams |
| 2021 | CoNLL | Generalising to German Plural Noun Classes, from the Perspective of a Recurrent Neural Network. | Verna Dankers, Anna Langedijk, Kate McCurdy, Adina Williams, Dieuwke Hupkes |
| 2021 | EMNLP | Sometimes We Want Ungrammatical Translations. | Prasanna Parthasarathi, Koustuv Sinha, Joelle Pineau, Adina Williams |
| 2021 | EMNLP | Masked Language Modeling and the Distributional Hypothesis: Order Word Matters Pre-training for Little. | Koustuv Sinha, Robin Jia, Dieuwke Hupkes, Joelle Pineau, Adina Williams, Douwe Kiela |
| 2021 | NAACL | Dynabench: Rethinking Benchmarking in NLP. | Douwe Kiela, Max Bartolo, Yixin Nie, Divyansh Kaushik, Atticus Geiger, Zhengxuan Wu, Bertie Vidgen, Grusha Prasad, Amanpreet Singh, Pratik Ringshia, Zhiyi Ma, Tristan Thrush, Sebastian Riedel, Zeerak Waseem, Pontus Stenetorp, Robin Jia, Mohit Bansal, Christopher Potts, Adina Williams |
| 2020 | ACL | Are Natural Language Inference Models IMPPRESsive? Learning IMPlicature and PRESupposition. | Paloma Jeretic, Alex Warstadt, Suvrat Bhooshan, Adina Williams |
| 2020 | ACL | A Tale of a Probe and a Parser. | Rowan Hall Maudslay, Josef Valvoda, Tiago Pimentel, Adina Williams, Ryan Cotterell |
| 2020 | ACL | Adversarial NLI: A New Benchmark for Natural Language Understanding. | Yixin Nie, Adina Williams, Emily Dinan, Mohit Bansal, Jason Weston, Douwe Kiela |
| 2020 | ACL | Information-Theoretic Probing for Linguistic Structure. | Tiago Pimentel, Josef Valvoda, Rowan Hall Maudslay, Ran Zmigrod, Adina Williams, Ryan Cotterell |
| 2020 | ACL | Predicting Declension Class from Form and Meaning. | Adina Williams, Tiago Pimentel, Hagen Blix, Arya D. McCarthy, Eleanor Chodroff, Ryan Cotterell |
| 2020 | EMNLP | Queens are Powerful too: Mitigating Gender Bias in Dialogue Generation. | Emily Dinan, Angela Fan, Adina Williams, Jack Urbanek, Douwe Kiela, Jason Weston |
| 2020 | EMNLP | Multi-Dimensional Gender Bias Classification. | Emily Dinan, Angela Fan, Ledell Wu, Jason Weston, Douwe Kiela, Adina Williams |
| 2020 | EMNLP | Intrinsic Probing through Dimension Selection. | Lucas Torroba Hennigen, Adina Williams, Ryan Cotterell |
| 2020 | EMNLP | Measuring the Similarity of Grammatical Gender Systems by Comparing Partitions. | Arya D. McCarthy, Adina Williams, Shijia Liu, David Yarowsky, Ryan Cotterell |
| 2020 | EMNLP | Pareto Probing: Trading Off Accuracy for Complexity. | Tiago Pimentel, Naomi Saphra, Adina Williams, Ryan Cotterell |
| 2019 | EMNLP | Quantifying the Semantic Core of Gender Systems. | Adina Williams, Damin E. Blasi, Lawrence Wolf-Sonkin, Hanna M. Wallach, Ryan Cotterell |
| 2019 | NAACL | On the Idiosyncrasies of the Mandarin Chinese Classifier System. | Shijia Liu, Hongyuan Mei, Adina Williams, Ryan Cotterell |
| 2018 | EMNLP | XNLI: Evaluating Cross-lingual Sentence Representations. | Alexis Conneau, Ruty Rinott, Guillaume Lample, Adina Williams, Samuel R. Bowman, Holger Schwenk, Veselin Stoyanov |
| 2018 | NAACL | A Broad-Coverage Challenge Corpus for Sentence Understanding through Inference. | Adina Williams, Nikita Nangia, Samuel R. Bowman |