Maarten Sap
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
85
Venues
12
Active years
2014–2026
Best venue rank
A*
Where they publish
Papers
85 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | Imperfectly Cooperative Human-AI Interactions: Comparing the Impacts of Human and AI Attributes in Simulated and User Studies. | Myke C. Cohen, Mingqian Zheng, Neel Bhandari, Hsien-Te Kao, Xuhui Zhou, Daniel Nguyen, Laura Cassani, Maarten Sap, Svitlana Volkova |
| 2026 | ACL | Social Story Frames: Contextual Reasoning about Narrative Intent and Reception. | Joel Mire, Maria Antoniak, Steven R. Wilson, Zexin Ma, Achyutarama R. Ganti, Andrew Piper, Maarten Sap |
| 2026 | CHI | Black LLMirror: User (Self) Perceptions in Black American English Interactions with LLMs. | Mikayla Campbell, Joel Mire, Mark Diaz, Maarten Sap |
| 2026 | CHI | PoliSim@CHI 2026: LLM Agent Simulation for Policy. | Yuxuan Li, Wesley Hanwen Deng, Xuhui Zhou, Kevin Klyman, Chun Yu, Yuanchun Shi, Nicholas Vincent, Amy X. Zhang, Maarten Sap, Sauvik Das, Hirokazu Shirado |
| 2026 | EACL | Out of Style: RAG's Fragility to Linguistic Variation. | Tianyu Cao, Neel Bhandari, Akhila Yerukola, Akari Asai, Maarten Sap |
| 2026 | EACL | Common Sense or Ableism? Rethinking Commonsense Reasoning Through the Lens of Disability. | Karina Halevy, Kimi Wenzel, Seyun Kim, Kyle Dean Bauer, Bruno Neira, Mona T. Diab, Maarten Sap |
| 2025 | ACL | Stereotype or Personalization? User Identity Biases Chatbot Recommendations. | Anjali Kantharuban, Jeremiah Milbauer, Maarten Sap, Emma Strubell, Graham Neubig |
| 2025 | ACL | Mitigating Bias in RAG: Controlling the Embedder. | Taeyoun Kim, Jacob Mitchell Springer, Aditi Raghunathan, Maarten Sap |
| 2025 | ACL | BIG5-CHAT: Shaping LLM Personalities Through Training on Human-Grounded Data. | Wenkai Li, Jiarui Liu, Andy Liu, Xuhui Zhou, Mona T. Diab, Maarten Sap |
| 2025 | ACL | Mind the Gesture: Evaluating AI Sensitivity to Culturally Offensive Non-Verbal Gestures. | Akhila Yerukola, Saadia Gabriel, Nanyun Peng, Maarten Sap |
| 2025 | AIES | Why (Not) Use AI? Analyzing People's Reasoning and Conditions for AI Acceptability. | Jimin Mun, Wei Bin Au Yeong, Wesley Hanwen Deng, Jana Schaich Borg, Maarten Sap |
| 2025 | CHI | User-Driven Value Alignment: Understanding Users' Perceptions and Strategies for Addressing Biased and Discriminatory Statements in AI Companions. | Xianzhe Fan, Qing Xiao, Xuhui Zhou, Jiaxin Pei, Maarten Sap, Zhicong Lu, Hong Shen |
| 2025 | CHI | Unanticipated Lessons from Communities: Navigating Society-CenteredResearch in the AI Era. | Ding Wang, Remi Denton, Anoop K. Sinha, Shruti Sheth, Lauren Wilcox, Maryam Mustafa, Motahhare Eslami, Ken Holstein, Maarten Sap, Angela D. R. Smith, Andrea G. Parker, Neha Kumar, Naveena Karusala, Tawanna R. Dillahunt, Jared Lee Katzman |
| 2025 | CVPR | AutoPresent: Designing Structured Visuals from Scratch. | Jiaxin Ge, Zora Zhiruo Wang, Xuhui Zhou, Yi-Hao Peng, Sanjay Subramanian, Qinyue Tan, Maarten Sap, Alane Suhr, Daniel Fried, Graham Neubig, Trevor Darrell |
| 2025 | EMNLP | SOCIAL SCAFFOLDS: A Generalization Framework for Social Understanding Tasks. | Ritam Dutt, Carolyn P. Ros, Maarten Sap |
| 2025 | EMNLP | Synthetic Socratic Debates: Examining Persona Effects on Moral Decision and Persuasion Dynamics. | Jiarui Liu, Yueqi Song, Yunze Xiao, Mingqian Zheng, Lindia Tjuatja, Jana Schaich Borg, Mona T. Diab, Maarten Sap |
| 2025 | EMNLP | Words Like Knives: Backstory-Personalized Modeling and Detection of Violent Communication. | Jocelyn J. Shen, Akhila Yerukola, Xuhui Zhou, Cynthia Breazeal, Maarten Sap, Hae-Won Park |
| 2025 | EMNLP | Let Them Down Easy! Contextual Effects of LLM Guardrails on User Perceptions and Preferences. | Mingqian Zheng, Wenjia Hu, Patrick Zhao, Motahhare Eslami, Jena D. Hwang, Faeze Brahman, Carolyn Rose, Maarten Sap |
| 2025 | ICML | On the Resilience of LLM-Based Multi-Agent Collaboration with Faulty Agents. | Jen-tse Huang, Jiaxu Zhou, Tailin Jin, Xuhui Zhou, Zixi Chen, Wenxuan Wang, Youliang Yuan, Michael R. Lyu, Maarten Sap |
| 2025 | ICML | SafetyAnalyst: Interpretable, Transparent, and Steerable Safety Moderation for AI Behavior. | Jing-Jing Li, Valentina Pyatkin, Max Kleiman-Weiner, Liwei Jiang, Nouha Dziri, Anne Collins, Jana Schaich Borg, Maarten Sap, Yejin Choi, Sydney Levine |
| 2025 | NAACL | Rejected Dialects: Biases Against African American Language in Reward Models. | Joel Mire, Zubin Trivadi Aysola, Daniel Chechelnitsky, Nicholas Deas, Chrysoula Zerva, Maarten Sap |
| 2025 | NAACL | NormAd: A Framework for Measuring the Cultural Adaptability of Large Language Models. | Abhinav Rao, Akhila Yerukola, Vishwa Shah, Katharina Reinecke, Maarten Sap |
| 2025 | NAACL | AI-LieDar : Examine the Trade-off Between Utility and Truthfulness in LLM Agents. | Zhe Su, Xuhui Zhou, Sanketh Rangreji, Anubha Kabra, Julia Mendelsohn, Faeze Brahman, Maarten Sap |
| 2025 | NAACL | REL-A.I.: An Interaction-Centered Approach To Measuring Human-LM Reliance. | Kaitlyn Zhou, Jena D. Hwang, Xiang Ren, Nouha Dziri, Dan Jurafsky, Maarten Sap |
| 2025 | NAACL | SOTOPIA-S4: a user-friendly system for flexible, customizable, and large-scale social simulation. | Xuhui Zhou, Zhe Su, Sophie Feng, Jiaxu Zhou, Jen-tse Huang, Hsien-Te Kao, Spencer Lynch, Svitlana Volkova, Tongshuang Wu, Anita Woolley, Hao Zhu, Maarten Sap |
| 2024 | AAAI | Value Kaleidoscope: Engaging AI with Pluralistic Human Values, Rights, and Duties. | Taylor Sorensen, Liwei Jiang, Jena D. Hwang, Sydney Levine, Valentina Pyatkin, Peter West, Nouha Dziri, Ximing Lu, Kavel Rao, Chandra Bhagavatula, Maarten Sap, John Tasioulas, Yejin Choi |
| 2024 | ACL | Where Do People Tell Stories Online? Story Detection Across Online Communities. | Maria Antoniak, Joel Mire, Maarten Sap, Elliott Ash, Andrew Piper |
| 2024 | ACL | SOTOPIA-π: Interactive Learning of Socially Intelligent Language Agents. | Ruiyi Wang, Haofei Yu, Wenxin Zhang, Zhengyang Qi, Maarten Sap, Yonatan Bisk, Graham Neubig, Hao Zhu |
| 2024 | ACL | Is the Pope Catholic? Yes, the Pope is Catholic. Generative Evaluation of Non-Literal Intent Resolution in LLMs. | Akhila Yerukola, Saujas Vaduguru, Daniel Fried, Maarten Sap |
| 2024 | ACL | Relying on the Unreliable: The Impact of Language Models' Reluctance to Express Uncertainty. | Kaitlyn Zhou, Jena D. Hwang, Xiang Ren, Maarten Sap |
| 2024 | AIES | Particip-AI: A Democratic Surveying Framework for Anticipating Future AI Use Cases, Harms and Benefits. | Jimin Mun, Liwei Jiang, Jenny T. Liang, Inyoung Cheong, Nicole DeCario, Yejin Choi, Tadayoshi Kohno, Maarten Sap |
| 2024 | CHI | Counterspeakers' Perspectives: Unveiling Barriers and AI Needs in the Fight against Online Hate. | Jimin Mun, Cathy Buerger, Jenny T. Liang, Joshua Garland, Maarten Sap |
| 2024 | EACL | Clever Hans or Neural Theory of Mind? Stress Testing Social Reasoning in Large Language Models. | Natalie Shapira, Mosh Levy, Seyed Hossein Alavi, Xuhui Zhou, Yejin Choi, Yoav Goldberg, Maarten Sap, Vered Shwartz |
| 2024 | EMNLP | The Empirical Variability of Narrative Perceptions of Social Media Texts. | Joel Mire, Maria Antoniak, Elliott Ash, Andrew Piper, Maarten Sap |
| 2024 | EMNLP | HEART-felt Narratives: Tracing Empathy and Narrative Style in Personal Stories with LLMs. | Jocelyn Shen, Joel Mire, Hae Park, Cynthia Breazeal, Maarten Sap |
| 2024 | EMNLP | Is this the real life? Is this just fantasy? The Misleading Success of Simulating Social Interactions With LLMs. | Xuhui Zhou, Zhe Su, Tiwalayo Eisape, Hyunwoo Kim, Maarten Sap |
| 2024 | ICLR | Leftover Lunch: Advantage-based Offline Reinforcement Learning for Language Models. | Ashutosh Baheti, Ximing Lu, Faeze Brahman, Ronan Le Bras, Maarten Sap, Mark O. Riedl |
| 2024 | ICLR | Can LLMs Keep a Secret? Testing Privacy Implications of Language Models via Contextual Integrity Theory. | Niloofar Mireshghallah, Hyunwoo Kim, Xuhui Zhou, Yulia Tsvetkov, Maarten Sap, Reza Shokri, Yejin Choi |
| 2024 | ICLR | SOTOPIA: Interactive Evaluation for Social Intelligence in Language Agents. | Xuhui Zhou, Hao Zhu, Leena Mathur, Ruohong Zhang, Haofei Yu, Zhengyang Qi, Louis-Philippe Morency, Yonatan Bisk, Daniel Fried, Graham Neubig, Maarten Sap |
| 2023 | ACL | Riveter: Measuring Power and Social Dynamics Between Entities. | Maria Antoniak, Anjalie Field, Jimin Mun, Melanie Walsh, Lauren F. Klein, Maarten Sap |
| 2023 | ACL | Detoxifying Text with MaRCo: Controllable Revision with Experts and Anti-Experts. | Skyler Hallinan, Alisa Liu, Yejin Choi, Maarten Sap |
| 2023 | ACL | From Dogwhistles to Bullhorns: Unveiling Coded Rhetoric with Language Models. | Julia Mendelsohn, Ronan Le Bras, Yejin Choi, Maarten Sap |
| 2023 | ACL | NLPositionality: Characterizing Design Biases of Datasets and Models. | Sebastin Santy, Jenny T. Liang, Ronan Le Bras, Katharina Reinecke, Maarten Sap |
| 2023 | ACL | COBRA Frames: Contextual Reasoning about Effects and Harms of Offensive Statements. | Xuhui Zhou, Hao Zhu, Akhila Yerukola, Thomas Davidson, Jena D. Hwang, Swabha Swayamdipta, Maarten Sap |
| 2023 | EMNLP | SODA: Million-scale Dialogue Distillation with Social Commonsense Contextualization. | Hyunwoo Kim, Jack Hessel, Liwei Jiang, Peter West, Ximing Lu, Youngjae Yu, Pei Zhou, Ronan Le Bras, Malihe Alikhani, Gunhee Kim, Maarten Sap, Yejin Choi |
| 2023 | EMNLP | FANToM: A Benchmark for Stress-testing Machine Theory of Mind in Interactions. | Hyunwoo Kim, Melanie Sclar, Xuhui Zhou, Ronan Le Bras, Gunhee Kim, Yejin Choi, Maarten Sap |
| 2023 | EMNLP | Beyond Denouncing Hate: Strategies for Countering Implied Biases and Stereotypes in Language. | Jimin Mun, Emily Allaway, Akhila Yerukola, Laura Vianna, Sarah-Jane Leslie, Maarten Sap |
| 2023 | EMNLP | Modeling Empathic Similarity in Personal Narratives. | Jocelyn Shen, Maarten Sap, Pedro Colon-Hernandez, Hae Park, Cynthia Breazeal |
| 2023 | EMNLP | Don't Take This Out of Context!: On the Need for Contextual Models and Evaluations for Stylistic Rewriting. | Akhila Yerukola, Xuhui Zhou, Elizabeth Clark, Maarten Sap |
| 2023 | EMNLP | BiasX: "Thinking Slow" in Toxic Content Moderation with Explanations of Implied Social Biases. | Yiming Zhang, Sravani Nanduri, Liwei Jiang, Tongshuang Wu, Maarten Sap |
| 2022 | ACL | Misinfo Reaction Frames: Reasoning about Readers' Reactions to News Headlines. | Saadia Gabriel, Skyler Hallinan, Maarten Sap, Pemi Nguyen, Franziska Roesner, Eunsol Choi, Yejin Choi |
| 2022 | ACL | ToxiGen: A Large-Scale Machine-Generated Dataset for Adversarial and Implicit Hate Speech Detection. | Thomas Hartvigsen, Saadia Gabriel, Hamid Palangi, Maarten Sap, Dipankar Ray, Ece Kamar |
| 2022 | EMNLP | ProsocialDialog: A Prosocial Backbone for Conversational Agents. | Hyunwoo Kim, Youngjae Yu, Liwei Jiang, Ximing Lu, Daniel Khashabi, Gunhee Kim, Yejin Choi, Maarten Sap |
| 2022 | EMNLP | Neural Theory-of-Mind? On the Limits of Social Intelligence in Large LMs. | Maarten Sap, Ronan Le Bras, Daniel Fried, Yejin Choi |
| 2022 | NAACL | Aligning to Social Norms and Values in Interactive Narratives. | Prithviraj Ammanabrolu, Liwei Jiang, Maarten Sap, Hannaneh Hajishirzi, Yejin Choi |
| 2022 | NAACL | Annotators with Attitudes: How Annotator Beliefs And Identities Bias Toxic Language Detection. | Maarten Sap, Swabha Swayamdipta, Laura Vianna, Xuhui Zhou, Yejin Choi, Noah A. Smith |
| 2021 | ACL | DExperts: Decoding-Time Controlled Text Generation with Experts and Anti-Experts. | Alisa Liu, Maarten Sap, Ximing Lu, Swabha Swayamdipta, Chandra Bhagavatula, Noah A. Smith, Yejin Choi |
| 2021 | EACL | Challenges in Automated Debiasing for Toxic Language Detection. | Xuhui Zhou, Maarten Sap, Swabha Swayamdipta, Yejin Choi, Noah A. Smith |
| 2021 | EMNLP | Just Say No: Analyzing the Stance of Neural Dialogue Generation in Offensive Contexts. | Ashutosh Baheti, Maarten Sap, Alan Ritter, Mark O. Riedl |
| 2021 | EMNLP | Documenting Large Webtext Corpora: A Case Study on the Colossal Clean Crawled Corpus. | Jesse Dodge, Maarten Sap, Ana Marasovic, William Agnew, Gabriel Ilharco, Dirk Groeneveld, Margaret Mitchell, Matt Gardner |
| 2021 | EMNLP | Crowdsourcing Beyond Annotation: Case Studies in Benchmark Data Collection. | Alane Suhr, Clara Vania, Nikita Nangia, Maarten Sap, Mark Yatskar, Samuel R. Bowman, Yoav Artzi |
| 2021 | NAACL | Detoxifying Language Models Risks Marginalizing Minority Voices. | Albert Xu, Eshaan Pathak, Eric Wallace, Suchin Gururangan, Maarten Sap, Dan Klein |
| 2020 | ACL | Exploring the Effect of Author and Reader Identity in Online Story Writing: the STORIESINTHEWILD Corpus. | Tal August, Maarten Sap, Elizabeth Clark, Katharina Reinecke, Noah A. Smith |
| 2020 | ACL | Social Bias Frames: Reasoning about Social and Power Implications of Language. | Maarten Sap, Saadia Gabriel, Lianhui Qin, Dan Jurafsky, Noah A. Smith, Yejin Choi |
| 2020 | ACL | Recollection versus Imagination: Exploring Human Memory and Cognition via Neural Language Models. | Maarten Sap, Eric Horvitz, Yejin Choi, Noah A. Smith, James W. Pennebaker |
| 2020 | ACL | Commonsense Reasoning for Natural Language Processing. | Maarten Sap, Vered Shwartz, Antoine Bosselut, Yejin Choi, Dan Roth |
| 2020 | EMNLP | Social Chemistry 101: Learning to Reason about Social and Moral Norms. | Maxwell Forbes, Jena D. Hwang, Vered Shwartz, Maarten Sap, Yejin Choi |
| 2020 | EMNLP | RealToxicityPrompts: Evaluating Neural Toxic Degeneration in Language Models. | Samuel Gehman, Suchin Gururangan, Maarten Sap, Yejin Choi, Noah A. Smith |
| 2020 | EMNLP | PowerTransformer: Unsupervised Controllable Revision for Biased Language Correction. | Xinyao Ma, Maarten Sap, Hannah Rashkin, Yejin Choi |
| 2019 | AAAI | ATOMIC: An Atlas of Machine Commonsense for If-Then Reasoning. | Maarten Sap, Ronan Le Bras, Emily Allaway, Chandra Bhagavatula, Nicholas Lourie, Hannah Rashkin, Brendan Roof, Noah A. Smith, Yejin Choi |
| 2019 | ACL | COMET: Commonsense Transformers for Automatic Knowledge Graph Construction. | Antoine Bosselut, Hannah Rashkin, Maarten Sap, Chaitanya Malaviya, Asli Celikyilmaz, Yejin Choi |
| 2019 | ACL | The Risk of Racial Bias in Hate Speech Detection. | Maarten Sap, Dallas Card, Saadia Gabriel, Yejin Choi, Noah A. Smith |
| 2019 | EMNLP | Social IQa: Commonsense Reasoning about Social Interactions. | Maarten Sap, Hannah Rashkin, Derek Chen, Ronan Le Bras, Yejin Choi |
| 2018 | ACL | Modeling Naive Psychology of Characters in Simple Commonsense Stories. | Hannah Rashkin, Antoine Bosselut, Maarten Sap, Kevin Knight, Yejin Choi |
| 2018 | ACL | Event2Mind: Commonsense Inference on Events, Intents, and Reactions. | Hannah Rashkin, Maarten Sap, Emily Allaway, Noah A. Smith, Yejin Choi |
| 2018 | NAACL | Sounding Board: A User-Centric and Content-Driven Social Chatbot. | Hao Fang, Hao Cheng, Maarten Sap, Elizabeth Clark, Ari Holtzman, Yejin Choi, Noah A. Smith, Mari Ostendorf |
| 2017 | CoNLL | The Effect of Different Writing Tasks on Linguistic Style: A Case Study of the ROC Story Cloze Task. | Roy Schwartz, Maarten Sap, Ioannis Konstas, Leila Zilles, Yejin Choi, Noah A. Smith |
| 2017 | EACL | Story Cloze Task: UW NLP System. | Roy Schwartz, Maarten Sap, Ioannis Konstas, Leila Zilles, Yejin Choi, Noah A. Smith |
| 2017 | EMNLP | Connotation Frames of Power and Agency in Modern Films. | Maarten Sap, Marcella Cindy Prasettio, Ari Holtzman, Hannah Rashkin, Yejin Choi |
| 2017 | EMNLP | DLATK: Differential Language Analysis ToolKit. | H. Andrew Schwartz, Salvatore Giorgi, Maarten Sap, Patrick Crutchley, Lyle H. Ungar, Johannes C. Eichstaedt |
| 2016 | PSB | Predicting Individual Well-Being Through the Language of Social Media. | H. Andrew Schwartz, Maarten Sap, Margaret L. Kern, Johannes C. Eichstaedt, Adam Kapelner, Megha Agrawal, Eduardo Blanco, Lukasz Dziurzynski, Gregory J. Park, David Stillwell, Michal Kosinski, Martin E. P. Seligman, Lyle H. Ungar |
| 2015 | NAACL | The role of personality, age, and gender in tweeting about mental illness. | Daniel Preotiuc-Pietro, Johannes C. Eichstaedt, Gregory J. Park, Maarten Sap, Laura Smith, Victoria Tobolsky, H. Andrew Schwartz, Lyle H. Ungar |
| 2015 | NAACL | Mental Illness Detection at the World Well-Being Project for the CLPsych 2015 Shared Task. | Daniel Preotiuc-Pietro, Maarten Sap, H. Andrew Schwartz, Lyle H. Ungar |
| 2015 | NAACL | Extracting Human Temporal Orientation from Facebook Language. | H. Andrew Schwartz, Gregory J. Park, Maarten Sap, Evan Weingarten, Johannes C. Eichstaedt, Margaret L. Kern, David Stillwell, Michal Kosinski, Jonah Berger, Martin E. P. Seligman, Lyle H. Ungar |
| 2014 | EMNLP | Developing Age and Gender Predictive Lexica over Social Media. | Maarten Sap, Gregory J. Park, Johannes C. Eichstaedt, Margaret L. Kern, David Stillwell, Michal Kosinski, Lyle H. Ungar, H. Andrew Schwartz |