| 2025 | CogSci | Cognitively Inspired Interpretability in Large Neural Networks. | Anna Leshinskaya, Taylor W. Webb, Ellie Pavlick, Jiahai Feng, Gustaw Opielka, Claire E. Stevenson, Idan A. Blank |
| 2025 | CogSci | Step-by-step analogical reasoning in humans and neural networks. | Jacob Russin, Joonhwa Kim, Ellie Pavlick, Michael J. Frank |
| 2025 | CogSci | Learning imposes a bottleneck beyond anatomical constraints: a computational investigation into the nature of WM capacity limits. | Aalok Sathe, Ellie Pavlick, Michael J. Frank |
| 2025 | EMNLP | A Knapsack by Any Other Name: Presentation impacts LLM performance on NP-hard problems. | Alex Duchnowski, Ellie Pavlick, Alexander Koller |
| 2025 | EMNLP | Paths Not Taken: Understanding and Mending the Multilingual Factual Recall Pipeline. | Meng Lu, Ruochen Zhang, Carsten Eickhoff, Ellie Pavlick |
| 2025 | ICLR | Dual Process Learning: Controlling Use of In-Context vs. In-Weights Strategies with Weight Forgetting. | Suraj Anand, Michael A. Lepori, Jack Merullo, Ellie Pavlick |
| 2025 | ICLR | The Same but Different: Structural Similarities and Differences in Multilingual Language Modeling. | Ruochen Zhang, Qinan Yu, Matianyu Zang, Carsten Eickhoff, Ellie Pavlick |
| 2024 | CogSci | Testing Causal Models of Word Meaning in LLMs. | Sam Musker, Ellie Pavlick |
| 2024 | CogSci | Human Curriculum Effects Emerge with In-Context Learning in Neural Networks. | Jacob Russin, Ellie Pavlick, Michael J. Frank |
| 2024 | CogSci | Transformer Mechanisms Mimic Frontostriatal Gating Operations When Trained on Human Working Memory Tasks. | Aaron Traylor, Jack Merullo, Michael J. Frank, Ellie Pavlick |
| 2024 | EACL | Does CLIP Bind Concepts? Probing Compositionality in Large Image Models. | Martha Lewis, Nihal V. Nayak, Peilin Yu, Jack Merullo, Qinan Yu, Stephen H. Bach, Ellie Pavlick |
| 2024 | EMNLP | Re-Evaluating Evaluation for Multilingual Summarization. | Jessica Zosa Forde, Ruochen Zhang, Lintang Sutawika, Alham Fikri Aji, Samuel Cahyawijaya, Genta Indra Winata, Minghao Wu, Carsten Eickhoff, Stella Biderman, Ellie Pavlick |
| 2024 | ICLR | Circuit Component Reuse Across Tasks in Transformer Language Models. | Jack Merullo, Carsten Eickhoff, Ellie Pavlick |
| 2024 | NAACL | mOthello: When Do Cross-Lingual Representation Alignment and Cross-Lingual Transfer Emerge in Multilingual Models? | Tianze Hua, Tian Yun, Ellie Pavlick |
| 2024 | NAACL | Language Models Implement Simple Word2Vec-style Vector Arithmetic. | Jack Merullo, Carsten Eickhoff, Ellie Pavlick |
| 2023 | EMNLP | Analyzing Modular Approaches for Visual Question Decomposition. | Apoorv Khandelwal, Ellie Pavlick, Chen Sun |
| 2023 | EMNLP | Are Language Models Worse than Humans at Following Prompts? It's Complicated. | Albert Webson, Alyssa Marie Loo, Qinan Yu, Ellie Pavlick |
| 2023 | EMNLP | Characterizing Mechanisms for Factual Recall in Language Models. | Qinan Yu, Jack Merullo, Ellie Pavlick |
| 2023 | EMNLP | Emergence of Abstract State Representations in Embodied Sequence Modeling. | Tian Yun, Zilai Zeng, Kunal Handa, Ashish V. Thapliyal, Bo Pang, Ellie Pavlick, Chen Sun |
| 2023 | ICLR | Linearly Mapping from Image to Text Space. | Jack Merullo, Louis Castricato, Carsten Eickhoff, Ellie Pavlick |
| 2023 | ICLR | Can Neural Networks Learn Implicit Logic from Physical Reasoning? | Aaron Traylor, Roman Feiman, Ellie Pavlick |
| 2022 | ICLR | Mapping Language Models to Grounded Conceptual Spaces. | Roma Patel, Ellie Pavlick |
| 2022 | ICLR | The MultiBERTs: BERT Reproductions for Robustness Analysis. | Thibault Sellam, Steve Yadlowsky, Ian Tenney, Jason Wei, Naomi Saphra, Alexander D'Amour, Tal Linzen, Jasmijn Bastings, Iulia Raluca Turc, Jacob Eisenstein, Dipanjan Das, Ellie Pavlick |
| 2022 | NAACL | Do Trajectories Encode Verb Meaning? | Dylan Ebert, Chen Sun, Ellie Pavlick |
| 2022 | NAACL | Do Prompt-Based Models Really Understand the Meaning of Their Prompts? | Albert Webson, Ellie Pavlick |
| 2021 | ACL | Are Rotten Apples Edible? Challenging Commonsense Inference Ability with Exceptions. | Nam Do, Ellie Pavlick |
| 2021 | ACL | Which Linguist Invented the Lightbulb? Presupposition Verification for Question-Answering. | Najoung Kim, Ellie Pavlick, Burcu Karagol Ayan, Deepak Ramachandran |
| 2021 | ACL | AND does not mean OR: Using Formal Languages to Study Language Models' Representations. | Aaron Traylor, Roman Feiman, Ellie Pavlick |
| 2021 | CogSci | The Anatomy of Discourse: Linguistic Predictors of Narrative and Argument Quality. | Sheridan Feucht, Babak Hemmatian, Rachel Avram, Alexander Wey, Kate Spitalnic, Muskaan Garg, Carsten Eickhoff, Ellie Pavlick, Bjrn Sandstede, Steven A. Sloman |
| 2021 | CogSci | Can computers tell a story? Discourse Structure in Computer-generated Text and Humans. | Alexander Wey, Babak Hemmatian, Rachel Avram, Sheridan Feucht, Kate Spitalnic, Muskaan Garg, Carsten Eickhoff, Ellie Pavlick, Bjrn Sandstede, Steven A. Sloman |
| 2021 | CoNLL | Can Language Models Encode Perceptual Structure Without Grounding? A Case Study in Color. | Mostafa Abdou, Artur Kulmizev, Daniel Hershcovich, Stella Frank, Ellie Pavlick, Anders Sgaard |
| 2021 | EMNLP | "Was it "stated" or was it "claimed"?: How linguistic bias affects generative language models. | Roma Patel, Ellie Pavlick |
| 2021 | EMNLP | Frequency Effects on Syntactic Rule Learning in Transformers. | Jason Wei, Dan Garrette, Tal Linzen, Ellie Pavlick |
| 2021 | EMNLP | Does Vision-and-Language Pretraining Improve Lexical Grounding? | Tian Yun, Chen Sun, Ellie Pavlick |
| 2021 | ICLR | Predicting Inductive Biases of Pre-Trained Models. | Charles Lovering, Rohan Jha, Tal Linzen, Ellie Pavlick |
| 2021 | RO-MAN | Spatial Language Understanding for Object Search in Partially Observed City-scale Environments. | Kaiyu Zheng, Deniz Bayazit, Rebecca Mathew, Ellie Pavlick, Stefanie Tellex |
| 2020 | ACL | Interpretability and Analysis in Neural NLP. | Yonatan Belinkov, Sebastian Gehrmann, Ellie Pavlick |
| 2020 | EMNLP | Do "Undocumented Workers" == "Illegal Aliens"? Differentiating Denotation and Connotation in Vector Spaces. | Albert Webson, Zhizhong Chen, Carsten Eickhoff, Ellie Pavlick |
| 2020 | ICRA | Grounding Language to Landmarks in Arbitrary Outdoor Environments. | Matthew Berg, Deniz Bayazit, Rebecca Mathew, Ariel Rotter-Aboyoun, Ellie Pavlick, Stefanie Tellex |
| 2019 | ACL | Right for the Wrong Reasons: Diagnosing Syntactic Heuristics in Natural Language Inference. | Tom McCoy, Ellie Pavlick, Tal Linzen |
| 2019 | ACL | BERT Rediscovers the Classical NLP Pipeline. | Ian Tenney, Dipanjan Das, Ellie Pavlick |
| 2019 | ACL | Can You Tell Me How to Get Past Sesame Street? Sentence-Level Pretraining Beyond Language Modeling. | Alex Wang, Jan Hula, Patrick Xia, Raghavendra Pappagari, R. Thomas McCoy, Roma Patel, Najoung Kim, Ian Tenney, Yinghui Huang, Katherin Yu, Shuning Jin, Berlin Chen, Benjamin Van Durme, Edouard Grave, Ellie Pavlick, Samuel R. Bowman |
| 2019 | CogSci | Emergent Compositionality in Signaling Games. | Nicholas Tomlin, Ellie Pavlick |
| 2019 | EMNLP | How well do NLI models capture verb veridicality? | Alexis Ross, Ellie Pavlick |
| 2019 | ICLR | What do you learn from context? Probing for sentence structure in contextualized word representations. | Ian Tenney, Patrick Xia, Berlin Chen, Alex Wang, Adam Poliak, R. Thomas McCoy, Najoung Kim, Benjamin Van Durme, Samuel R. Bowman, Dipanjan Das, Ellie Pavlick |
| 2018 | EMNLP | Learning Scalar Adjective Intensity from Paraphrases. | Anne Cocos, Veronica Wharton, Ellie Pavlick, Marianna Apidianaki, Chris Callison-Burch |
| 2018 | EMNLP | WikiAtomicEdits: A Multilingual Corpus of Wikipedia Edits for Modeling Language and Discourse. | Manaal Faruqui, Ellie Pavlick, Ian Tenney, Dipanjan Das |
| 2018 | EMNLP | Collecting Diverse Natural Language Inference Problems for Sentence Representation Evaluation. | Adam Poliak, Aparajita Haldar, Rachel Rudinger, J. Edward Hu, Ellie Pavlick, Aaron Steven White, Benjamin Van Durme |
| 2018 | EMNLP | Collecting Diverse Natural Language Inference Problems for Sentence Representation Evaluation. | Adam Poliak, Aparajita Haldar, Rachel Rudinger, J. Edward Hu, Ellie Pavlick, Aaron Steven White, Benjamin Van Durme |
| 2017 | ACL | Identifying 1950s American Jazz Musicians: Fine-Grained IsA Extraction via Modifier Composition. | Ellie Pavlick, Marius Pasca |
| 2016 | ACL | Most "babies" are "little" and most "problems" are "huge": Compositional Entailment in Adjective-Nouns. | Ellie Pavlick, Chris Callison-Burch |
| 2016 | ACL | Simple PPDB: A Paraphrase Database for Simplification. | Ellie Pavlick, Chris Callison-Burch |
| 2016 | EMNLP | Tense Manages to Predict Implicative Behavior in Verbs. | Ellie Pavlick, Chris Callison-Burch |
| 2016 | EMNLP | The Gun Violence Database: A new task and data set for NLP. | Ellie Pavlick, Heng Ji, Xiaoman Pan, Chris Callison-Burch |
| 2015 | ACL | Adding Semantics to Data-Driven Paraphrasing. | Ellie Pavlick, Johan Bos, Malvina Nissim, Charley Beller, Benjamin Van Durme, Chris Callison-Burch |
| 2015 | ACL | Domain-Specific Paraphrase Extraction. | Ellie Pavlick, Juri Ganitkevitch, Tsz Ping Chan, Xuchen Yao, Benjamin Van Durme, Chris Callison-Burch |
| 2015 | ACL | PPDB 2.0: Better paraphrase ranking, fine-grained entailment relations, word embeddings, and style classification. | Ellie Pavlick, Pushpendre Rastogi, Juri Ganitkevitch, Benjamin Van Durme, Chris Callison-Burch |
| 2015 | ACL | FrameNet+: Fast Paraphrastic Tripling of FrameNet. | Ellie Pavlick, Travis Wolfe, Pushpendre Rastogi, Chris Callison-Burch, Mark Dredze, Benjamin Van Durme |
| 2015 | HCOMP | Extracting Structured Information via Automatic + Human Computation. | Ellie Pavlick, Chris Callison-Burch |
| 2015 | NAACL | Crowdsourcing for NLP. | Chris Callison-Burch, Lyle H. Ungar, Ellie Pavlick |
| 2015 | NAACL | Inducing Lexical Style Properties for Paraphrase and Genre Differentiation. | Ellie Pavlick, Ani Nenkova |
| 2014 | ACL | Are Two Heads Better than One? Crowdsourced Translation via a Two-Step Collaboration of Non-Professional Translators and Editors. | Rui Yan, Mingkun Gao, Ellie Pavlick, Chris Callison-Burch |
| 2014 | CSCW | Crowdsourcing for grammatical error correction. | Ellie Pavlick, Rui Yan, Chris Callison-Burch |
| 2014 | HCOMP | Poetry of the Crowd: A Human Computation Algorithm to Convert Prose into Rhyming Verse. | Quanze Chen, Chenyang Lei, Wei Xu, Ellie Pavlick, Chris Callison-Burch |