| 2026 | ACL | Language Models Don't Know What You Want: Evaluating Personalization in Deep Research Needs Real Users. | Nishant Balepur, Malachi Hamada, Varsha Kishore, Sergey Feldman, Amanpreet Singh, Pao Siangliulue, Joseph Chee Chang, Eunsol Choi, Jordan Lee Boyd-Graber, Aakanksha Naik |
| 2026 | ACL | BenchMarker: An Education-Inspired Toolkit for Highlighting Flaws in Multiple-Choice Benchmarks. | Nishant Balepur, Bhavya Rajasekaran, Hyunjin Jane Oh, Michael Xie, Atrey Desai, Vipul Gupta, Steven James Moore, Eunsol Choi, Rachel Rudinger, Jordan Lee Boyd-Graber |
| 2026 | CHI | Envisioning Future Food, Technology, and Health: Teens' Perspectives Through Design Fiction. | Chun-Han Ariel Wang, Eunsol Choi, Norman Makoto Su, Chia-Fang Chung |
| 2026 | EACL | SAGE: Steerable Agentic Data Generation for Deep Search with Execution Feedback. | Fangyuan Xu, Rujun Han, Yanfei Chen, Zifeng Wang, I-Hung Hsu, Jun Yan, Vishy Tirumalashetty, Eunsol Choi, Tomas Pfister, Chen-Yu Lee |
| 2025 | ACL | CaLMQA: Exploring culturally specific long-form question answering across 23 languages. | Shane Arora, Marzena Karpinska, Hung-Ting Chen, Ipsita Bhattacharjee, Mohit Iyyer, Eunsol Choi |
| 2025 | ACL | RefreshKV: Updating Small KV Cache During Long-form Generation. | Fangyuan Xu, Tanya Goyal, Eunsol Choi |
| 2025 | EMNLP | Scaling Rich Style-Prompted Text-to-Speech Datasets. | Anuj Diwan, Zhisheng Zheng, David Harwath, Eunsol Choi |
| 2025 | EMNLP | User Feedback in Human-LLM Dialogues: A Lens to Understand Users But Noisy as a Learning Signal. | Yuhan Liu, Michael JQ Zhang, Eunsol Choi |
| 2025 | EMNLP | Improving LLM-as-a-Judge Inference with the Judgment Distribution. | Victor Wang, Michael JQ Zhang, Eunsol Choi |
| 2025 | ICLR | Modeling Future Conversation Turns to Teach LLMs to Ask Clarifying Questions. | Michael J. Q. Zhang, W. Bradley Knox, Eunsol Choi |
| 2025 | ICML | Diverging Preferences: When do Annotators Disagree and do Models Know? | Michael J. Q. Zhang, Zhilin Wang, Jena D. Hwang, Yi Dong, Olivier Delalleau, Yejin Choi, Eunsol Choi, Xiang Ren, Valentina Pyatkin |
| 2025 | NAACL | Open-World Evaluation for Retrieving Diverse Perspectives. | Hung-Ting Chen, Eunsol Choi |
| 2025 | NAACL | From Distributional to Overton Pluralism: Investigating Large Language Model Alignment. | Thom Lake, Eunsol Choi, Greg Durrett |
| 2025 | NAACL | Clarify When Necessary: Resolving Ambiguity Through Interaction with LMs. | Michael J. Q. Zhang, Eunsol Choi |
| 2025 | UIST | Scratchable Memory: A Scratch-Activated Olfactory Audio System. | Eunsol Choi, Christy Spackman, Byron Lahey |
| 2024 | ACL | KIWI: A Dataset of Knowledge-Intensive Writing Instructions for Answering Research Questions. | Fangyuan Xu, Kyle Lo, Luca Soldaini, Bailey Kuehl, Eunsol Choi, David Wadden |
| 2024 | CHI | Aligning Data with the Goals of an Organization and Its Workers: Designing Data Labeling for Social Service Case Notes. | Apoorva Gondimalla, Varshinee Sreekanth, Govind Joshi, Whitney Nelson, Eunsol Choi, Stephen C. Slota, Sherri R. Greenberg, Kenneth R. Fleischmann, Min Kyung Lee |
| 2024 | EMNLP | Textless Speech-to-Speech Translation With Limited Parallel Data. | Anuj Diwan, Anirudh Srinivasan, David Harwath, Eunsol Choi |
| 2024 | EMNLP | Exploring Design Choices for Building Language-Specific LLMs. | Atula Tejaswi, Nilesh Gupta, Eunsol Choi |
| 2024 | ICLR | Learning to Reject with a Fixed Predictor: Application to Decontextualization. | Christopher Mohri, Daniel Andor, Eunsol Choi, Michael Collins, Anqi Mao, Yutao Zhong |
| 2024 | ICLR | RECOMP: Improving Retrieval-Augmented LMs with Context Compression and Selective Augmentation. | Fangyuan Xu, Weijia Shi, Eunsol Choi |
| 2024 | ICML | BAT: Learning to Reason about Spatial Sounds with Large Language Models. | Zhisheng Zheng, Puyuan Peng, Ziyang Ma, Xie Chen, Eunsol Choi, David Harwath |
| 2024 | NAACL | Complex Claim Verification with Evidence Retrieved in the Wild. | Jifan Chen, Grace Kim, Aniruddh Sriram, Greg Durrett, Eunsol Choi |
| 2024 | NAACL | Crafting In-context Examples according to LMs' Parametric Knowledge. | Yoonsang Lee, Pranav Atreya, Xi Ye, Eunsol Choi |
| 2023 | ACL | When to Use Efficient Self Attention? Profiling Text, Speech and Image Transformer Variants. | Anuj Diwan, Eunsol Choi, David Harwath |
| 2023 | ACL | Quantifying Train-Evaluation Overlap with Nearest Neighbors. | Gauri Kambhatla, Thuy Nguyen, Eunsol Choi |
| 2023 | ACL | Can LMs Learn New Entities from Descriptions? Challenges in Propagating Injected Knowledge. | Yasumasa Onoe, Michael J. Q. Zhang, Shankar Padmanabhan, Greg Durrett, Eunsol Choi |
| 2023 | ACL | Concise Answers to Complex Questions: Summarization of Long-form Answers. | Abhilash Potluri, Fangyuan Xu, Eunsol Choi |
| 2023 | ACL | A Critical Evaluation of Evaluations for Long-form Question Answering. | Fangyuan Xu, Yixiao Song, Mohit Iyyer, Eunsol Choi |
| 2023 | EACL | DiffQG: Generating Questions to Summarize Factual Changes. | Jeremy R. Cole, Palak Jain, Julian Martin Eisenschlos, Michael J. Q. Zhang, Eunsol Choi, Bhuwan Dhingra |
| 2023 | EMNLP | Continually Improving Extractive QA via Human Feedback. | Ge Gao, Hung-Ting Chen, Yoav Artzi, Eunsol Choi |
| 2023 | EMNLP | Mitigating Temporal Misalignment by Discarding Outdated Facts. | Michael J. Q. Zhang, Eunsol Choi |
| 2023 | ICASSP | Continual Learning for On-Device Speech Recognition Using Disentangled Conformers. | Anuj Diwan, Ching-Feng Yeh, Wei-Ning Hsu, Paden Tomasello, Eunsol Choi, David Harwath, Abdelrahman Mohamed |
| 2022 | ACL | Misinfo Reaction Frames: Reasoning about Readers' Reactions to News Headlines. | Saadia Gabriel, Skyler Hallinan, Maarten Sap, Pemi Nguyen, Franziska Roesner, Eunsol Choi, Yejin Choi |
| 2022 | ACL | Simulating Bandit Learning from User Feedback for Extractive Question Answering. | Ge Gao, Eunsol Choi, Yoav Artzi |
| 2022 | ACL | How Do We Answer Complex Questions: Discourse Structure of Long-form Answers. | Fangyuan Xu, Junyi Jessy Li, Eunsol Choi |
| 2022 | EMNLP | Beyond Counting Datasets: A Survey of Multilingual Dataset Construction and Necessary Resources. | Xinyan Yu, Trina Chatterjee, Akari Asai, Junjie Hu, Eunsol Choi |
| 2022 | EMNLP | Generating Literal and Implied Subquestions to Fact-check Complex Claims. | Jifan Chen, Aniruddh Sriram, Eunsol Choi, Greg Durrett |
| 2022 | EMNLP | Rich Knowledge Sources Bring Complex Knowledge Conflicts: Recalibrating Models to Reflect Conflicting Evidence. | Hung-Ting Chen, Michael J. Q. Zhang, Eunsol Choi |
| 2022 | EMNLP | Why is Winoground Hard? Investigating Failures in Visuolinguistic Compositionality. | Anuj Diwan, Layne Berry, Eunsol Choi, David Harwath, Kyle Mahowald |
| 2022 | EMNLP | TyDiP: A Dataset for Politeness Classification in Nine Typologically Diverse Languages. | Anirudh Srinivasan, Eunsol Choi |
| 2022 | NAACL | Entity Cloze By Date: What LMs Know About Unseen Entities. | Yasumasa Onoe, Michael J. Q. Zhang, Eunsol Choi, Greg Durrett |
| 2022 | NAACL | Modeling Exemplification in Long-form Question Answering via Retrieval. | Shufan Wang, Fangyuan Xu, Laure Thompson, Eunsol Choi, Mohit Iyyer |
| 2021 | ACL | Challenges in Information-Seeking QA: Unanswerable Questions and Paragraph Retrieval. | Akari Asai, Eunsol Choi |
| 2021 | ACL | Knowing More About Questions Can Help: Improving Calibration in Question Answering. | Shujian Zhang, Chengyue Gong, Eunsol Choi |
| 2021 | EMNLP | Can NLI Models Verify QA Systems' Predictions? | Jifan Chen, Eunsol Choi, Greg Durrett |
| 2021 | EMNLP | SituatedQA: Incorporating Extra-Linguistic Contexts into QA. | Michael J. Q. Zhang, Eunsol Choi |
| 2021 | EMNLP | Learning with Different Amounts of Annotation: From Zero to Many Labels. | Shujian Zhang, Chengyue Gong, Eunsol Choi |
| 2021 | Interact | What Happens to My Instagram Account After I Die? Re-imagining Social Media as a Commemorative Space for Remembrance and Recovery. | Soonho Kwon, Eunsol Choi, Minseok Kim, Sunah Hwang, Dongwoo Kim, Younah Kang |
| 2021 | NAACL | XOR QA: Cross-lingual Open-Retrieval Question Answering. | Akari Asai, Jungo Kasai, Jonathan H. Clark, Kenton Lee, Eunsol Choi, Hannaneh Hajishirzi |
| 2020 | EMNLP | Entities as Experts: Sparse Memory Access with Entity Supervision. | Thibault Fvry, Livio Baldini Soares, Nicholas FitzGerald, Eunsol Choi, Tom Kwiatkowski |
| 2019 | ICLR | FlowQA: Grasping Flow in History for Conversational Machine Comprehension. | Hsin-Yuan Huang, Eunsol Choi, Wen-tau Yih |
| 2019 | NAACL | No Permanent Friends or Enemies: Tracking Relationships between Nations from News. | Xiaochuang Han, Eunsol Choi, Chenhao Tan |
| 2019 | NAACL | pair2vec: Compositional Word-Pair Embeddings for Cross-Sentence Inference. | Mandar Joshi, Eunsol Choi, Omer Levy, Daniel S. Weld, Luke Zettlemoyer |
| 2018 | ACL | Ultra-Fine Entity Typing. | Eunsol Choi, Omer Levy, Yejin Choi, Luke Zettlemoyer |
| 2018 | EMNLP | QuAC: Question Answering in Context. | Eunsol Choi, He He, Mohit Iyyer, Mark Yatskar, Wen-tau Yih, Yejin Choi, Percy Liang, Luke Zettlemoyer |
| 2018 | EMNLP | Neural Metaphor Detection in Context. | Ge Gao, Eunsol Choi, Yejin Choi, Luke Zettlemoyer |
| 2017 | ACL | Coarse-to-Fine Question Answering for Long Documents. | Eunsol Choi, Daniel Hewlett, Jakob Uszkoreit, Illia Polosukhin, Alexandre Lacoste, Jonathan Berant |
| 2017 | ACL | TriviaQA: A Large Scale Distantly Supervised Challenge Dataset for Reading Comprehension. | Mandar Joshi, Eunsol Choi, Daniel S. Weld, Luke Zettlemoyer |
| 2017 | CoNLL | Zero-Shot Relation Extraction via Reading Comprehension. | Omer Levy, Minjoon Seo, Eunsol Choi, Luke Zettlemoyer |
| 2017 | EMNLP | Truth of Varying Shades: Analyzing Language in Fake News and Political Fact-Checking. | Hannah Rashkin, Eunsol Choi, Jin Yea Jang, Svitlana Volkova, Yejin Choi |
| 2016 | ACL | Document-level Sentiment Inference with Social, Faction, and Discourse Context. | Eunsol Choi, Hannah Rashkin, Luke Zettlemoyer, Yejin Choi |
| 2016 | LREC | Extracting Structured Scholarly Information from the Machine Translation Literature. | Eunsol Choi, Matic Horvat, Jonathan May, Kevin Knight, Daniel Marcu |
| 2015 | ACL | Scalable Semantic Parsing with Partial Ontologies. | Eunsol Choi, Tom Kwiatkowski, Luke Zettlemoyer |
| 2013 | EMNLP | Scaling Semantic Parsers with On-the-Fly Ontology Matching. | Tom Kwiatkowski, Eunsol Choi, Yoav Artzi, Luke Zettlemoyer |
| 2012 | ACL | Hedge Detection as a Lens on Framing in the GMO Debates: A Position Paper. | Eunsol Choi, Chenhao Tan, Lillian Lee, Cristian Danescu-Niculescu-Mizil, Jennifer Spindel |