| 2025 | ICML | SafeArena: Evaluating the Safety of Autonomous Web Agents. | Ada Defne Tur, Nicholas Meade, Xing Han L, Alejandra Zambrano, Arkil Patel, Esin Durmus, Spandana Gella, Karolina Stanczak, Siva Reddy |
| 2024 | ICLR | Towards Understanding Sycophancy in Language Models. | Mrinank Sharma, Meg Tong, Tomasz Korbak, David Duvenaud, Amanda Askell, Samuel R. Bowman, Esin Durmus, Zac Hatfield-Dodds, Scott R. Johnston, Shauna Kravec, Timothy Maxwell, Sam McCandlish, Kamal Ndousse, Oliver Rausch, Nicholas Schiefer, Da Yan, Miranda Zhang, Ethan Perez |
| 2024 | NAACL | NLP Systems That Can't Tell Use from Mention Censor Counterspeech, but Teaching the Distinction Helps. | Kristina Gligoric, Myra Cheng, Lucia Zheng, Esin Durmus, Dan Jurafsky |
| 2023 | ACL | Marked Personas: Using Natural Language Prompts to Measure Stereotypes in Language Models. | Myra Cheng, Esin Durmus, Dan Jurafsky |
| 2023 | ACL | Contrastive Error Attribution for Finetuned Language Models. | Faisal Ladhak, Esin Durmus, Tatsunori Hashimoto |
| 2023 | ACL | Towards Reference-free Text Simplification Evaluation with a BERT Siamese Network Architecture. | Xinran Zhao, Esin Durmus, Dit-Yan Yeung |
| 2023 | EACL | When Do Pre-Training Biases Propagate to Downstream Tasks? A Case Study in Text Summarization. | Faisal Ladhak, Esin Durmus, Mirac Suzgun, Tianyi Zhang, Dan Jurafsky, Kathleen R. McKeown, Tatsunori Hashimoto |
| 2023 | ICML | Whose Opinions Do Language Models Reflect? | Shibani Santurkar, Esin Durmus, Faisal Ladhak, Cinoo Lee, Percy Liang, Tatsunori Hashimoto |
| 2022 | ACL | Spurious Correlations in Reference-Free Evaluation of Text Generation. | Esin Durmus, Faisal Ladhak, Tatsunori Hashimoto |
| 2022 | ACL | Faithful or Extractive? On Mitigating the Faithfulness-Abstractiveness Trade-off in Abstractive Summarization. | Faisal Ladhak, Esin Durmus, He He, Claire Cardie, Kathleen R. McKeown |
| 2022 | EMNLP | Improving Faithfulness by Augmenting Negative Summaries from Fake Documents. | Tianshu Wang, Faisal Ladhak, Esin Durmus, He He |
| 2022 | ICLR | Language modeling via stochastic processes. | Rose E. Wang, Esin Durmus, Noah D. Goodman, Tatsunori Hashimoto |
| 2021 | ACL | Leveraging Topic Relatedness for Argument Persuasion. | Xinran Zhao, Esin Durmus, Hongming Zhang, Claire Cardie |
| 2020 | ACL | FEQA: A Question Answering Evaluation Framework for Faithfulness Assessment in Abstractive Summarization. | Esin Durmus, He He, Mona T. Diab |
| 2020 | EMNLP | WikiLingua: A New Benchmark Dataset for Multilingual Abstractive Summarization. | Faisal Ladhak, Esin Durmus, Claire Cardie, Kathleen R. McKeown |
| 2020 | EMNLP | Exploring the Role of Argument Structure in Online Debate Persuasion. | Jialu Li, Esin Durmus, Claire Cardie |
| 2019 | ACL | A Corpus for Modeling User and Language Effects in Argumentation on Online Debating. | Esin Durmus, Claire Cardie |
| 2019 | ACL | Determining Relative Argument Specificity and Stance for Complex Argumentative Structures. | Esin Durmus, Faisal Ladhak, Claire Cardie |
| 2019 | EMNLP | The Role of Pragmatic and Discourse Context in Determining Argument Impact. | Esin Durmus, Faisal Ladhak, Claire Cardie |
| 2019 | WWW | Modeling the Factors of User Success in Online Debate. | Esin Durmus, Claire Cardie |
| 2018 | NAACL | Exploring the Role of Prior Beliefs for Argument Persuasion. | Esin Durmus, Claire Cardie |