Skip to content

Maarten Sap

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

85

Venues

12

Active years

2014–2026

Best venue rank

A*

Where they publish

Papers

85 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLImperfectly Cooperative Human-AI Interactions: Comparing the Impacts of Human and AI Attributes in Simulated and User Studies.Myke C. Cohen, Mingqian Zheng, Neel Bhandari, Hsien-Te Kao, Xuhui Zhou, Daniel Nguyen, Laura Cassani, Maarten Sap, Svitlana Volkova
2026ACLSocial Story Frames: Contextual Reasoning about Narrative Intent and Reception.Joel Mire, Maria Antoniak, Steven R. Wilson, Zexin Ma, Achyutarama R. Ganti, Andrew Piper, Maarten Sap
2026CHIBlack LLMirror: User (Self) Perceptions in Black American English Interactions with LLMs.Mikayla Campbell, Joel Mire, Mark Diaz, Maarten Sap
2026CHIPoliSim@CHI 2026: LLM Agent Simulation for Policy.Yuxuan Li, Wesley Hanwen Deng, Xuhui Zhou, Kevin Klyman, Chun Yu, Yuanchun Shi, Nicholas Vincent, Amy X. Zhang, Maarten Sap, Sauvik Das, Hirokazu Shirado
2026EACLOut of Style: RAG's Fragility to Linguistic Variation.Tianyu Cao, Neel Bhandari, Akhila Yerukola, Akari Asai, Maarten Sap
2026EACLCommon Sense or Ableism? Rethinking Commonsense Reasoning Through the Lens of Disability.Karina Halevy, Kimi Wenzel, Seyun Kim, Kyle Dean Bauer, Bruno Neira, Mona T. Diab, Maarten Sap
2025ACLStereotype or Personalization? User Identity Biases Chatbot Recommendations.Anjali Kantharuban, Jeremiah Milbauer, Maarten Sap, Emma Strubell, Graham Neubig
2025ACLMitigating Bias in RAG: Controlling the Embedder.Taeyoun Kim, Jacob Mitchell Springer, Aditi Raghunathan, Maarten Sap
2025ACLBIG5-CHAT: Shaping LLM Personalities Through Training on Human-Grounded Data.Wenkai Li, Jiarui Liu, Andy Liu, Xuhui Zhou, Mona T. Diab, Maarten Sap
2025ACLMind the Gesture: Evaluating AI Sensitivity to Culturally Offensive Non-Verbal Gestures.Akhila Yerukola, Saadia Gabriel, Nanyun Peng, Maarten Sap
2025AIESWhy (Not) Use AI? Analyzing People's Reasoning and Conditions for AI Acceptability.Jimin Mun, Wei Bin Au Yeong, Wesley Hanwen Deng, Jana Schaich Borg, Maarten Sap
2025CHIUser-Driven Value Alignment: Understanding Users' Perceptions and Strategies for Addressing Biased and Discriminatory Statements in AI Companions.Xianzhe Fan, Qing Xiao, Xuhui Zhou, Jiaxin Pei, Maarten Sap, Zhicong Lu, Hong Shen
2025CHIUnanticipated Lessons from Communities: Navigating Society-CenteredResearch in the AI Era.Ding Wang, Remi Denton, Anoop K. Sinha, Shruti Sheth, Lauren Wilcox, Maryam Mustafa, Motahhare Eslami, Ken Holstein, Maarten Sap, Angela D. R. Smith, Andrea G. Parker, Neha Kumar, Naveena Karusala, Tawanna R. Dillahunt, Jared Lee Katzman
2025CVPRAutoPresent: Designing Structured Visuals from Scratch.Jiaxin Ge, Zora Zhiruo Wang, Xuhui Zhou, Yi-Hao Peng, Sanjay Subramanian, Qinyue Tan, Maarten Sap, Alane Suhr, Daniel Fried, Graham Neubig, Trevor Darrell
2025EMNLPSOCIAL SCAFFOLDS: A Generalization Framework for Social Understanding Tasks.Ritam Dutt, Carolyn P. Ros, Maarten Sap
2025EMNLPSynthetic Socratic Debates: Examining Persona Effects on Moral Decision and Persuasion Dynamics.Jiarui Liu, Yueqi Song, Yunze Xiao, Mingqian Zheng, Lindia Tjuatja, Jana Schaich Borg, Mona T. Diab, Maarten Sap
2025EMNLPWords Like Knives: Backstory-Personalized Modeling and Detection of Violent Communication.Jocelyn J. Shen, Akhila Yerukola, Xuhui Zhou, Cynthia Breazeal, Maarten Sap, Hae-Won Park
2025EMNLPLet Them Down Easy! Contextual Effects of LLM Guardrails on User Perceptions and Preferences.Mingqian Zheng, Wenjia Hu, Patrick Zhao, Motahhare Eslami, Jena D. Hwang, Faeze Brahman, Carolyn Rose, Maarten Sap
2025ICMLOn the Resilience of LLM-Based Multi-Agent Collaboration with Faulty Agents.Jen-tse Huang, Jiaxu Zhou, Tailin Jin, Xuhui Zhou, Zixi Chen, Wenxuan Wang, Youliang Yuan, Michael R. Lyu, Maarten Sap
2025ICMLSafetyAnalyst: Interpretable, Transparent, and Steerable Safety Moderation for AI Behavior.Jing-Jing Li, Valentina Pyatkin, Max Kleiman-Weiner, Liwei Jiang, Nouha Dziri, Anne Collins, Jana Schaich Borg, Maarten Sap, Yejin Choi, Sydney Levine
2025NAACLRejected Dialects: Biases Against African American Language in Reward Models.Joel Mire, Zubin Trivadi Aysola, Daniel Chechelnitsky, Nicholas Deas, Chrysoula Zerva, Maarten Sap
2025NAACLNormAd: A Framework for Measuring the Cultural Adaptability of Large Language Models.Abhinav Rao, Akhila Yerukola, Vishwa Shah, Katharina Reinecke, Maarten Sap
2025NAACLAI-LieDar : Examine the Trade-off Between Utility and Truthfulness in LLM Agents.Zhe Su, Xuhui Zhou, Sanketh Rangreji, Anubha Kabra, Julia Mendelsohn, Faeze Brahman, Maarten Sap
2025NAACLREL-A.I.: An Interaction-Centered Approach To Measuring Human-LM Reliance.Kaitlyn Zhou, Jena D. Hwang, Xiang Ren, Nouha Dziri, Dan Jurafsky, Maarten Sap
2025NAACLSOTOPIA-S4: a user-friendly system for flexible, customizable, and large-scale social simulation.Xuhui Zhou, Zhe Su, Sophie Feng, Jiaxu Zhou, Jen-tse Huang, Hsien-Te Kao, Spencer Lynch, Svitlana Volkova, Tongshuang Wu, Anita Woolley, Hao Zhu, Maarten Sap
2024AAAIValue Kaleidoscope: Engaging AI with Pluralistic Human Values, Rights, and Duties.Taylor Sorensen, Liwei Jiang, Jena D. Hwang, Sydney Levine, Valentina Pyatkin, Peter West, Nouha Dziri, Ximing Lu, Kavel Rao, Chandra Bhagavatula, Maarten Sap, John Tasioulas, Yejin Choi
2024ACLWhere Do People Tell Stories Online? Story Detection Across Online Communities.Maria Antoniak, Joel Mire, Maarten Sap, Elliott Ash, Andrew Piper
2024ACLSOTOPIA-π: Interactive Learning of Socially Intelligent Language Agents.Ruiyi Wang, Haofei Yu, Wenxin Zhang, Zhengyang Qi, Maarten Sap, Yonatan Bisk, Graham Neubig, Hao Zhu
2024ACLIs the Pope Catholic? Yes, the Pope is Catholic. Generative Evaluation of Non-Literal Intent Resolution in LLMs.Akhila Yerukola, Saujas Vaduguru, Daniel Fried, Maarten Sap
2024ACLRelying on the Unreliable: The Impact of Language Models' Reluctance to Express Uncertainty.Kaitlyn Zhou, Jena D. Hwang, Xiang Ren, Maarten Sap
2024AIESParticip-AI: A Democratic Surveying Framework for Anticipating Future AI Use Cases, Harms and Benefits.Jimin Mun, Liwei Jiang, Jenny T. Liang, Inyoung Cheong, Nicole DeCario, Yejin Choi, Tadayoshi Kohno, Maarten Sap
2024CHICounterspeakers' Perspectives: Unveiling Barriers and AI Needs in the Fight against Online Hate.Jimin Mun, Cathy Buerger, Jenny T. Liang, Joshua Garland, Maarten Sap
2024EACLClever Hans or Neural Theory of Mind? Stress Testing Social Reasoning in Large Language Models.Natalie Shapira, Mosh Levy, Seyed Hossein Alavi, Xuhui Zhou, Yejin Choi, Yoav Goldberg, Maarten Sap, Vered Shwartz
2024EMNLPThe Empirical Variability of Narrative Perceptions of Social Media Texts.Joel Mire, Maria Antoniak, Elliott Ash, Andrew Piper, Maarten Sap
2024EMNLPHEART-felt Narratives: Tracing Empathy and Narrative Style in Personal Stories with LLMs.Jocelyn Shen, Joel Mire, Hae Park, Cynthia Breazeal, Maarten Sap
2024EMNLPIs this the real life? Is this just fantasy? The Misleading Success of Simulating Social Interactions With LLMs.Xuhui Zhou, Zhe Su, Tiwalayo Eisape, Hyunwoo Kim, Maarten Sap
2024ICLRLeftover Lunch: Advantage-based Offline Reinforcement Learning for Language Models.Ashutosh Baheti, Ximing Lu, Faeze Brahman, Ronan Le Bras, Maarten Sap, Mark O. Riedl
2024ICLRCan LLMs Keep a Secret? Testing Privacy Implications of Language Models via Contextual Integrity Theory.Niloofar Mireshghallah, Hyunwoo Kim, Xuhui Zhou, Yulia Tsvetkov, Maarten Sap, Reza Shokri, Yejin Choi
2024ICLRSOTOPIA: Interactive Evaluation for Social Intelligence in Language Agents.Xuhui Zhou, Hao Zhu, Leena Mathur, Ruohong Zhang, Haofei Yu, Zhengyang Qi, Louis-Philippe Morency, Yonatan Bisk, Daniel Fried, Graham Neubig, Maarten Sap
2023ACLRiveter: Measuring Power and Social Dynamics Between Entities.Maria Antoniak, Anjalie Field, Jimin Mun, Melanie Walsh, Lauren F. Klein, Maarten Sap
2023ACLDetoxifying Text with MaRCo: Controllable Revision with Experts and Anti-Experts.Skyler Hallinan, Alisa Liu, Yejin Choi, Maarten Sap
2023ACLFrom Dogwhistles to Bullhorns: Unveiling Coded Rhetoric with Language Models.Julia Mendelsohn, Ronan Le Bras, Yejin Choi, Maarten Sap
2023ACLNLPositionality: Characterizing Design Biases of Datasets and Models.Sebastin Santy, Jenny T. Liang, Ronan Le Bras, Katharina Reinecke, Maarten Sap
2023ACLCOBRA Frames: Contextual Reasoning about Effects and Harms of Offensive Statements.Xuhui Zhou, Hao Zhu, Akhila Yerukola, Thomas Davidson, Jena D. Hwang, Swabha Swayamdipta, Maarten Sap
2023EMNLPSODA: Million-scale Dialogue Distillation with Social Commonsense Contextualization.Hyunwoo Kim, Jack Hessel, Liwei Jiang, Peter West, Ximing Lu, Youngjae Yu, Pei Zhou, Ronan Le Bras, Malihe Alikhani, Gunhee Kim, Maarten Sap, Yejin Choi
2023EMNLPFANToM: A Benchmark for Stress-testing Machine Theory of Mind in Interactions.Hyunwoo Kim, Melanie Sclar, Xuhui Zhou, Ronan Le Bras, Gunhee Kim, Yejin Choi, Maarten Sap
2023EMNLPBeyond Denouncing Hate: Strategies for Countering Implied Biases and Stereotypes in Language.Jimin Mun, Emily Allaway, Akhila Yerukola, Laura Vianna, Sarah-Jane Leslie, Maarten Sap
2023EMNLPModeling Empathic Similarity in Personal Narratives.Jocelyn Shen, Maarten Sap, Pedro Colon-Hernandez, Hae Park, Cynthia Breazeal
2023EMNLPDon't Take This Out of Context!: On the Need for Contextual Models and Evaluations for Stylistic Rewriting.Akhila Yerukola, Xuhui Zhou, Elizabeth Clark, Maarten Sap
2023EMNLPBiasX: "Thinking Slow" in Toxic Content Moderation with Explanations of Implied Social Biases.Yiming Zhang, Sravani Nanduri, Liwei Jiang, Tongshuang Wu, Maarten Sap
2022ACLMisinfo Reaction Frames: Reasoning about Readers' Reactions to News Headlines.Saadia Gabriel, Skyler Hallinan, Maarten Sap, Pemi Nguyen, Franziska Roesner, Eunsol Choi, Yejin Choi
2022ACLToxiGen: A Large-Scale Machine-Generated Dataset for Adversarial and Implicit Hate Speech Detection.Thomas Hartvigsen, Saadia Gabriel, Hamid Palangi, Maarten Sap, Dipankar Ray, Ece Kamar
2022EMNLPProsocialDialog: A Prosocial Backbone for Conversational Agents.Hyunwoo Kim, Youngjae Yu, Liwei Jiang, Ximing Lu, Daniel Khashabi, Gunhee Kim, Yejin Choi, Maarten Sap
2022EMNLPNeural Theory-of-Mind? On the Limits of Social Intelligence in Large LMs.Maarten Sap, Ronan Le Bras, Daniel Fried, Yejin Choi
2022NAACLAligning to Social Norms and Values in Interactive Narratives.Prithviraj Ammanabrolu, Liwei Jiang, Maarten Sap, Hannaneh Hajishirzi, Yejin Choi
2022NAACLAnnotators with Attitudes: How Annotator Beliefs And Identities Bias Toxic Language Detection.Maarten Sap, Swabha Swayamdipta, Laura Vianna, Xuhui Zhou, Yejin Choi, Noah A. Smith
2021ACLDExperts: Decoding-Time Controlled Text Generation with Experts and Anti-Experts.Alisa Liu, Maarten Sap, Ximing Lu, Swabha Swayamdipta, Chandra Bhagavatula, Noah A. Smith, Yejin Choi
2021EACLChallenges in Automated Debiasing for Toxic Language Detection.Xuhui Zhou, Maarten Sap, Swabha Swayamdipta, Yejin Choi, Noah A. Smith
2021EMNLPJust Say No: Analyzing the Stance of Neural Dialogue Generation in Offensive Contexts.Ashutosh Baheti, Maarten Sap, Alan Ritter, Mark O. Riedl
2021EMNLPDocumenting Large Webtext Corpora: A Case Study on the Colossal Clean Crawled Corpus.Jesse Dodge, Maarten Sap, Ana Marasovic, William Agnew, Gabriel Ilharco, Dirk Groeneveld, Margaret Mitchell, Matt Gardner
2021EMNLPCrowdsourcing Beyond Annotation: Case Studies in Benchmark Data Collection.Alane Suhr, Clara Vania, Nikita Nangia, Maarten Sap, Mark Yatskar, Samuel R. Bowman, Yoav Artzi
2021NAACLDetoxifying Language Models Risks Marginalizing Minority Voices.Albert Xu, Eshaan Pathak, Eric Wallace, Suchin Gururangan, Maarten Sap, Dan Klein
2020ACLExploring the Effect of Author and Reader Identity in Online Story Writing: the STORIESINTHEWILD Corpus.Tal August, Maarten Sap, Elizabeth Clark, Katharina Reinecke, Noah A. Smith
2020ACLSocial Bias Frames: Reasoning about Social and Power Implications of Language.Maarten Sap, Saadia Gabriel, Lianhui Qin, Dan Jurafsky, Noah A. Smith, Yejin Choi
2020ACLRecollection versus Imagination: Exploring Human Memory and Cognition via Neural Language Models.Maarten Sap, Eric Horvitz, Yejin Choi, Noah A. Smith, James W. Pennebaker
2020ACLCommonsense Reasoning for Natural Language Processing.Maarten Sap, Vered Shwartz, Antoine Bosselut, Yejin Choi, Dan Roth
2020EMNLPSocial Chemistry 101: Learning to Reason about Social and Moral Norms.Maxwell Forbes, Jena D. Hwang, Vered Shwartz, Maarten Sap, Yejin Choi
2020EMNLPRealToxicityPrompts: Evaluating Neural Toxic Degeneration in Language Models.Samuel Gehman, Suchin Gururangan, Maarten Sap, Yejin Choi, Noah A. Smith
2020EMNLPPowerTransformer: Unsupervised Controllable Revision for Biased Language Correction.Xinyao Ma, Maarten Sap, Hannah Rashkin, Yejin Choi
2019AAAIATOMIC: An Atlas of Machine Commonsense for If-Then Reasoning.Maarten Sap, Ronan Le Bras, Emily Allaway, Chandra Bhagavatula, Nicholas Lourie, Hannah Rashkin, Brendan Roof, Noah A. Smith, Yejin Choi
2019ACLCOMET: Commonsense Transformers for Automatic Knowledge Graph Construction.Antoine Bosselut, Hannah Rashkin, Maarten Sap, Chaitanya Malaviya, Asli Celikyilmaz, Yejin Choi
2019ACLThe Risk of Racial Bias in Hate Speech Detection.Maarten Sap, Dallas Card, Saadia Gabriel, Yejin Choi, Noah A. Smith
2019EMNLPSocial IQa: Commonsense Reasoning about Social Interactions.Maarten Sap, Hannah Rashkin, Derek Chen, Ronan Le Bras, Yejin Choi
2018ACLModeling Naive Psychology of Characters in Simple Commonsense Stories.Hannah Rashkin, Antoine Bosselut, Maarten Sap, Kevin Knight, Yejin Choi
2018ACLEvent2Mind: Commonsense Inference on Events, Intents, and Reactions.Hannah Rashkin, Maarten Sap, Emily Allaway, Noah A. Smith, Yejin Choi
2018NAACLSounding Board: A User-Centric and Content-Driven Social Chatbot.Hao Fang, Hao Cheng, Maarten Sap, Elizabeth Clark, Ari Holtzman, Yejin Choi, Noah A. Smith, Mari Ostendorf
2017CoNLLThe Effect of Different Writing Tasks on Linguistic Style: A Case Study of the ROC Story Cloze Task.Roy Schwartz, Maarten Sap, Ioannis Konstas, Leila Zilles, Yejin Choi, Noah A. Smith
2017EACLStory Cloze Task: UW NLP System.Roy Schwartz, Maarten Sap, Ioannis Konstas, Leila Zilles, Yejin Choi, Noah A. Smith
2017EMNLPConnotation Frames of Power and Agency in Modern Films.Maarten Sap, Marcella Cindy Prasettio, Ari Holtzman, Hannah Rashkin, Yejin Choi
2017EMNLPDLATK: Differential Language Analysis ToolKit.H. Andrew Schwartz, Salvatore Giorgi, Maarten Sap, Patrick Crutchley, Lyle H. Ungar, Johannes C. Eichstaedt
2016PSBPredicting Individual Well-Being Through the Language of Social Media.H. Andrew Schwartz, Maarten Sap, Margaret L. Kern, Johannes C. Eichstaedt, Adam Kapelner, Megha Agrawal, Eduardo Blanco, Lukasz Dziurzynski, Gregory J. Park, David Stillwell, Michal Kosinski, Martin E. P. Seligman, Lyle H. Ungar
2015NAACLThe role of personality, age, and gender in tweeting about mental illness.Daniel Preotiuc-Pietro, Johannes C. Eichstaedt, Gregory J. Park, Maarten Sap, Laura Smith, Victoria Tobolsky, H. Andrew Schwartz, Lyle H. Ungar
2015NAACLMental Illness Detection at the World Well-Being Project for the CLPsych 2015 Shared Task.Daniel Preotiuc-Pietro, Maarten Sap, H. Andrew Schwartz, Lyle H. Ungar
2015NAACLExtracting Human Temporal Orientation from Facebook Language.H. Andrew Schwartz, Gregory J. Park, Maarten Sap, Evan Weingarten, Johannes C. Eichstaedt, Margaret L. Kern, David Stillwell, Michal Kosinski, Jonah Berger, Martin E. P. Seligman, Lyle H. Ungar
2014EMNLPDeveloping Age and Gender Predictive Lexica over Social Media.Maarten Sap, Gregory J. Park, Johannes C. Eichstaedt, Margaret L. Kern, David Stillwell, Michal Kosinski, Lyle H. Ungar, H. Andrew Schwartz