| 2026 | ACL | Probing Multimodal Large Language Models on Cognitive Biases in Chinese Short-Video Misinformation. | Jen-tse Huang, Chang Chen, Shiyang Lai, Wenxuan Wang, Michelle R. Kaufman, Mark Dredze |
| 2026 | ACL | MedScore: Generalizable Factuality Evaluation of Open-ended Long-form Medical Answers by Domain-adapted Claim Decomposition and Verification. | Heyuan Huang, Alexandra DeLucia, Vijay Murari Tiyyala, Mark Dredze |
| 2026 | ACL | Evaluating Implicit Biases in LLM Reasoning through Logic Grid Puzzles. | Fatima Jahara, Mark Dredze, Sharon Levy |
| 2026 | ACL | Domain Generalizable AI Guardrails with Augmented Policy Training. | Minqian Liu, Ioana Baldini, David Rabinowitz, David S. Rosenberg, Sebastian Gehrmann, Mark Dredze |
| 2026 | ACL | Task Matters: Knowledge Requirements Shape LLM Responses to Context-Memory Conflict. | Kaiser Sun, Fan Bai, Mark Dredze |
| 2025 | ACL | Making FETCH! Happen: Finding Emergent Dog Whistles Through Common Habitats. | Kuleen Sasse, Carlos Alejandro Aguirre, Isabel Cachola, Sharon Levy, Mark Dredze |
| 2025 | EMNLP | LLMs are Better Than You Think: Label-Guided In-Context Learning for Named Entity Recognition. | Fan Bai, Hamid Hassanzadeh, Ardavan Saeedi, Mark Dredze |
| 2025 | EMNLP | Evaluating the Evaluators: Are readability metrics good measures of readability? | Isabel Cachola, Daniel Khashabi, Mark Dredze |
| 2025 | EMNLP | DnDScore: Decontextualization and Decomposition for Factuality Verification in Long-Form Text Generation. | Miriam Wanner, Benjamin Van Durme, Mark Dredze |
| 2025 | NAACL | RAG LLMs are Not Safer: A Safety Analysis of Retrieval-Augmented Generation for Large Language Models. | Bang An, Shiyue Zhang, Mark Dredze |
| 2025 | NAACL | Benchmarking Large Language Models on Answering and Explaining Challenging Medical Questions. | Hanjie Chen, Zhouxiang Fang, Yash Singla, Mark Dredze |
| 2024 | ACL | Multi-Task Transfer Matters During Instruction-Tuning. | David Mueller, Mark Dredze, Nicholas Andrews |
| 2024 | EMNLP | Schema-Driven Information Extraction from Heterogeneous Tables. | Fan Bai, Junmo Kang, Gabriel Stanovsky, Dayne Freitag, Mark Dredze, Alan Ritter |
| 2024 | EMNLP | Academics Can Contribute to Domain-Specialized Language Models. | Mark Dredze, Genta Indra Winata, Prabhanjan Kambadur, Shijie Wu, Ozan Irsoy, Steven Lu, Vadim Dabravolski, David S. Rosenberg, Sebastian Gehrmann |
| 2024 | EMNLP | Gender Bias in Decision-Making with Large Language Models: A Study of Relationship Conflicts. | Sharon Levy, William D. Adler, Tahilin Sanchez Karver, Mark Dredze, Michelle R. Kaufman |
| 2024 | EMNLP | Evaluating Biases in Context-Dependent Sexual and Reproductive Health Questions. | Sharon Levy, Tahilin Sanchez Karver, William D. Adler, Michelle R. Kaufman, Mark Dredze |
| 2024 | EMNLP | Do LLMs Plan Like Human Writers? Comparing Journalist Coverage of Press Releases with LLMs. | Alexander Spangher, Nanyun Peng, Sebastian Gehrmann, Mark Dredze |
| 2023 | ACL | Characterization of Stigmatizing Language in Medical Records. | Keith Harrigian, Ayah Zirikly, Brant Chee, Alya Ahmad, Anne Links, Somnath Saha, Mary Catherine Beach, Mark Dredze |
| 2023 | ACL | Joint End-to-end Semantic Proto-role Labeling. | Elizabeth Spaulding, Gary Kazantsev, Mark Dredze |
| 2023 | ACL | Geo-Seq2seq: Twitter User Geolocation on Noisy Data through Sequence to Sequence Learning. | Jingyu Zhang, Alexandra DeLucia, Chenyu Zhang, Mark Dredze |
| 2023 | ACL | MixCE: Training Autoregressive Language Models by Mixing Forward and Reverse Cross-Entropies. | Shiyue Zhang, Shijie Wu, Ozan Irsoy, Steven Lu, Mohit Bansal, Mark Dredze, David S. Rosenberg |
| 2022 | ACL | Updated Headline Generation: Creating Updated Summaries for Evolving News Stories. | Sheena Panthaplackel, Adrian Benton, Mark Dredze |
| 2022 | COLING | Changes in Tweet Geolocation over Time: A Study with Carmen 2.0. | Jingyu Zhang, Alexandra DeLucia, Mark Dredze |
| 2022 | EMNLP | Bernice: A Multilingual Pre-trained Encoder for Twitter. | Alexandra DeLucia, Shijie Wu, Aaron Mueller, Carlos Alejandro Aguirre, Philip Resnik, Mark Dredze |
| 2022 | EMNLP | Do Text-to-Text Multi-Task Learners Suffer from Task Conflict? | David Mueller, Nicholas Andrews, Mark Dredze |
| 2021 | ACL | Cross-Lingual Transfer in Zero-Shot Cross-Language Entity Linking. | Elliot Schumacher, James Mayfield, Mark Dredze |
| 2021 | EACL | Gender and Racial Fairness in Depression Research using Social Media. | Carlos Alejandro Aguirre, Keith Harrigian, Mark Dredze |
| 2021 | EMNLP | Everything Is All It Takes: A Multipronged Strategy for Zero-Shot Cross-Lingual Information Extraction. | Mahsa Yarmohammadi, Shijie Wu, Marc Marone, Haoran Xu, Seth Ebner, Guanghui Qin, Yunmo Chen, Jialiang Guo, Craig Harman, Kenton Murray, Aaron Steven White, Mark Dredze, Benjamin Van Durme |
| 2021 | ICMLA | Proxy Model Explanations for Time Series RNNs. | Zach Wood-Doughty, Isabel Cachola, Mark Dredze |
| 2021 | NAACL | Fine-tuning Encoders for Improved Monolingual and Zero-shot Polylingual Neural Topic Modeling. | Aaron Mueller, Mark Dredze |
| 2020 | ACL | Sources of Transfer in Multilingual Named Entity Recognition. | David Mueller, Nicholas Andrews, Mark Dredze |
| 2020 | ACL | Clinical Concept Linking with Contextualized Neural Representations. | Elliot Schumacher, Andriy Mulyar, Mark Dredze |
| 2020 | AMIA | Crowd-Diagnosis: When the Public Turns to Social Media to Obtain Clinical Diagnoses. | Alicia L. Nobles, Eric C. Leas, Mark Dredze, Christopher A. Longhurst, Davey Smith, John W. Ayers |
| 2020 | EMNLP | Do Models of Mental Health Based on Social Media Data Generalize? | Keith Harrigian, Carlos Alejandro Aguirre, Mark Dredze |
| 2020 | EMNLP | Do Explicit Alignments Robustly Improve Multilingual Encoders? | Shijie Wu, Mark Dredze |
| 2020 | ICWSM | Examining Peer-to-Peer and Patient-Provider Interactions on a Social Media Community Facilitating Ask the Doctor Services. | Alicia L. Nobles, Eric C. Leas, Mark Dredze, John W. Ayers |
| 2020 | ICWSM | Aligning Public Feedback to Requests for Comments on Regulations.gov. | Manya Wadhwa, Silvio Amir, Mark Dredze |
| 2019 | EMNLP | Beto, Bentz, Becas: The Surprising Cross-Lingual Effectiveness of BERT. | Shijie Wu, Mark Dredze |
| 2019 | FlAIRS | Visual Attention Model for Cross-Sectional Stock Return Prediction and End-to-End Multimodal Market Representation Learning. | Ran Zhao, Yuntian Deng, Mark Dredze, Arun Verma, David S. Rosenberg, Amanda Stent |
| 2018 | EMNLP | Challenges of Using Text Classifiers for Causal Inference. | Zach Wood-Doughty, Ilya Shpitser, Mark Dredze |
| 2018 | NAACL | Deep Dirichlet Multinomial Regression. | Adrian Benton, Mark Dredze |
| 2018 | SIGIR | Summarizing Entities using Distantly Supervised Information Extractors. | Travis Wolfe, Annabelle Carrell, Mark Dredze, Benjamin Van Durme |
| 2017 | AAAI | Examining Patterns of Influenza Vaccination in Social Media. | Xiaolei Huang, Michael C. Smith, Michael J. Paul, Dmytro Ryzhkov, Sandra Crouse Quinn, David A. Broniatowski, Mark Dredze |
| 2017 | ACL | Bayesian Modeling of Lexical Resources for Low-Resource Settings. | Nicholas Andrews, Mark Dredze, Benjamin Van Durme, Jason Eisner |
| 2017 | ACL | Pocket Knowledge Base Population. | Travis Wolfe, Mark Dredze, Benjamin Van Durme |
| 2017 | AMIA | Monitoring Real-time Spatial Public Health Discussions in the Context of Vaccine Hesitancy. | Michael C. Smith, Mark Dredze, Sandra Crouse Quinn, David A. Broniatowski |
| 2017 | ASRU | Leveraging side information for speaker identification with the Enron conversational telephone speech collection. | Ning Gao, Gregory Sell, Douglas W. Oard, Mark Dredze |
| 2017 | IJCNLP | CADET: Computer Assisted Discovery Extraction and Translation. | Benjamin Van Durme, Tom Lippincott, Kevin Duh, Deana Burchfield, Adam Poliak, Cash Costello, Tim Finin, Scott Miller, James Mayfield, Philipp Koehn, Craig Harman, Dawn J. Lawrie, Chandler May, Max Thomas, Annabelle Carrell, Julianne Chaloux, Tongfei Chen, Alex Comerford, Mark Dredze, Benjamin Glass, Shudong Hao, Patrick Martin, Pushpendre Rastogi, Rashmi Sankepally, Travis Wolfe, Ying-Ying Tran, Ted Zhang |
| 2017 | SIGIR | Support for Interactive Identification of Mentioned Entities in Conversational Speech. | Ning Gao, Douglas W. Oard, Mark Dredze |
| 2016 | AAAI | Collective Supervision of Topic Models for Predicting Surveys with Social Media. | Adrian Benton, Michael J. Paul, Braden Hancock, Mark Dredze |
| 2016 | AAAI | Studying Anonymous Health Issues and Substance Use on College Campuses with Yik Yak. | Animesh Koratana, Mark Dredze, Margaret S. Chisolm, Matthew W. Johnson, Michael J. Paul |
| 2016 | ACL | Learning Multiview Embeddings of Twitter Users. | Adrian Benton, Raman Arora, Mark Dredze |
| 2016 | ACL | Improving Named Entity Recognition for Chinese Social Media with Word Segmentation Representation Learning. | Nanyun Peng, Mark Dredze |
| 2016 | CHI | Discovering Shifts to Suicidal Ideation from Mental Health Content in Social Media. | Munmun De Choudhury, Emre Kiciman, Mark Dredze, Glen Coppersmith, Mrinal Kumar |
| 2016 | CIKM | How Twitter is Changing the Nature of Financial News Discovery. | Mark Dredze, Prabhanjan Kambadur, Gary Kazantsev, Gideon Mann, Miles Osborne |
| 2016 | EMNLP | A Study of Imitation Learning Methods for Semantic Role Labeling. | Travis Wolfe, Mark Dredze, Benjamin Van Durme |
| 2016 | NAACL | Geolocation for Twitter: Timing Matters. | Mark Dredze, Miles Osborne, Prabhanjan Kambadur |
| 2016 | NAACL | Embedding Lexical Features via Low-Rank Tensors. | Mo Yu, Mark Dredze, Raman Arora, Matthew R. Gormley |
| 2015 | AAAI | Worldwide Influenza Surveillance through Twitter. | Michael J. Paul, Mark Dredze, David A. Broniatowski, Nicholas Generous |
| 2015 | AAAI | The Hurricane Sandy Twitter Corpus. | Haoyu Wang, Eduard H. Hovy, Mark Dredze |
| 2015 | ACL | FrameNet+: Fast Paraphrastic Tripling of FrameNet. | Ellie Pavlick, Travis Wolfe, Pushpendre Rastogi, Chris Callison-Burch, Mark Dredze, Benjamin Van Durme |
| 2015 | ACL | An Empirical Study of Chinese Name Matching and Applications. | Nanyun Peng, Mo Yu, Mark Dredze |
| 2015 | EMNLP | Improved Relation Extraction with Feature-Rich Compositional Embedding Models. | Matthew R. Gormley, Mo Yu, Mark Dredze |
| 2015 | EMNLP | Named Entity Recognition for Chinese Social Media with Jointly Trained Embeddings. | Nanyun Peng, Mark Dredze |
| 2015 | NAACL | Entity Linking for Spoken Language. | Adrian Benton, Mark Dredze |
| 2015 | NAACL | From ADHD to SAD: Analyzing the Language of Mental Health on Twitter through Self-Reported Diagnoses. | Glen Coppersmith, Mark Dredze, Craig Harman, Kristy Hollingshead |
| 2015 | NAACL | CLPsych 2015 Shared Task: Depression and PTSD on Twitter. | Glen Coppersmith, Mark Dredze, Craig Harman, Kristy Hollingshead, Margaret Mitchell |
| 2015 | NAACL | A Concrete Chinese NLP Pipeline. | Nanyun Peng, Francis Ferraro, Mo Yu, Nicholas Andrews, Jay DeYoung, Max Thomas, Matthew R. Gormley, Travis Wolfe, Craig Harman, Benjamin Van Durme, Mark Dredze |
| 2015 | NAACL | Predicate Argument Alignment using a Global Coherence Model. | Travis Wolfe, Mark Dredze, Benjamin Van Durme |
| 2015 | NAACL | Combining Word Embeddings and Feature Embeddings for Fine-grained Relation Extraction. | Mo Yu, Matthew R. Gormley, Mark Dredze |
| 2014 | ACL | Robust Entity Clustering via Phylogenetic Inference. | Nicholas Andrews, Jason Eisner, Mark Dredze |
| 2014 | ACL | Low-Resource Semantic Role Labeling. | Matthew R. Gormley, Margaret Mitchell, Benjamin Van Durme, Mark Dredze |
| 2014 | ACL | Learning Polylingual Topic Models from Code-Switched Social Media Documents. | Nanyun Peng, Yiming Wang, Mark Dredze |
| 2014 | ACL | Improving Lexical Embeddings with Semantic Knowledge. | Mo Yu, Mark Dredze |
| 2014 | ICWSM | Measuring Post Traumatic Stress Disorder in Twitter. | Glen Coppersmith, Craig Harman, Mark Dredze |
| 2014 | ICWSM | Facebook, Twitter and Google Plus for Breaking News: Is There a Winner? | Miles Osborne, Mark Dredze |
| 2013 | ACL | PARMA: A Predicate Argument Aligner. | Travis Wolfe, Benjamin Van Durme, Mark Dredze, Nicholas Andrews, Charley Beller, Chris Callison-Burch, Jay DeYoung, Justin Snyder, Jonathan Weese, Tan Xu, Xuchen Yao |
| 2013 | NAACL | Broadly Improving User Classification via Communication-Based Name and Location Clustering on Twitter. | Shane Bergsma, Mark Dredze, Benjamin Van Durme, Theresa Wilson, David Yarowsky |
| 2013 | NAACL | What's in a Domain? Multi-Domain Learning for Multi-Attribute Data. | Mahesh Joshi, Mark Dredze, William W. Cohen, Carolyn P. Ros |
| 2013 | NAACL | Separating Fact from Fear: Tracking Flu Infections on Twitter. | Alex Lamb, Michael J. Paul, Mark Dredze |
| 2013 | NAACL | Drug Extraction from the Web: Summarizing Drug Experiences with Multi-Dimensional Topic Models. | Michael J. Paul, Mark Dredze |
| 2013 | NAACL | Topic Models and Metadata for Visualizing Text Corpora. | Justin Snyder, Rebecca Knowles, Mark Dredze, Matthew Gormley, Travis Wolfe |
| 2012 | ACL | Fast Syntactic Analysis for Statistical Language Modeling via Substructure Sharing and Uptraining. | Ariya Rastrow, Mark Dredze, Sanjeev Khudanpur |
| 2012 | AMIA | Twitter as a Source for Learning about Patient Safety Events. | Ralph Passarella, Atul Nakhasi, Sarah G. Bell, Michael J. Paul, Peter Pronovost, Mark Dredze |
| 2012 | EMNLP | Name Phylogeny: A Generative Model of String Variation. | Nicholas Andrews, Jason Eisner, Mark Dredze |
| 2012 | EMNLP | Multi-Domain Learning: When Do Domains Matter? | Mahesh Joshi, Mark Dredze, William W. Cohen, Carolyn P. Ros |
| 2012 | ICASSP | New ℌ | Koby Crammer, Alex Kulesza, Mark Dredze |
| 2012 | Interspeech | Deriving conversation-based features from unlabeled speech for discriminative language modeling. | Damianos Karakos, Brian Roark, Izhak Shafran, Kenji Sagae, Maider Lehr, Emily Tucker Prud'hommeaux, Puyang Xu, Nathan Glenn, Sanjeev Khudanpur, Murat Saraclar, Daniel M. Bikel, Mark Dredze, Chris Callison-Burch, Yuan Cao, Keith B. Hall, Eva Hasler, Philipp Koehn, Adam Lopez, Matt Post, Darcey Riley |
| 2012 | Interspeech | Efficient Structured Language Modeling for Speech Recognition. | Ariya Rastrow, Mark Dredze, Sanjeev Khudanpur |
| 2012 | NAACL | Shared Components Topic Models. | Matthew R. Gormley, Mark Dredze, Benjamin Van Durme, Jason Eisner |
| 2012 | NAACL | Entity Clustering Across Languages. | Spence Green, Nicholas Andrews, Matthew R. Gormley, Mark Dredze, Christopher D. Manning |
| 2012 | NAACL | Revisiting the Case for Explicit Syntactic Information in Language Models. | Ariya Rastrow, Sanjeev Khudanpur, Mark Dredze |
| 2011 | ACL | Learning Sub-Word Units for Open Vocabulary Speech Recognition. | Carolina Parada, Mark Dredze, Abhinav Sethy, Ariya Rastrow |
| 2011 | ASRU | Estimating document frequencies in a speech corpus. | Damianos Karakos, Mark Dredze, Ken Ward Church, Aren Jansen, Sanjeev Khudanpur |
| 2011 | ASRU | Efficient discriminative training of long-span language models. | Ariya Rastrow, Mark Dredze, Sanjeev Khudanpur |
| 2011 | ASRU | Adapting n-gram maximum entropy language models with conditional entropy regularization. | Ariya Rastrow, Mark Dredze, Sanjeev Khudanpur |
| 2011 | ICASSP | Hill climbing on speech lattices: A new rescoring framework. | Ariya Rastrow, Markus Dreyer, Abhinav Sethy, Sanjeev Khudanpur, Bhuvana Ramabhadran, Mark Dredze |
| 2011 | Interspeech | OOV Sensitive Named-Entity Recognition in Speech. | Carolina Parada, Mark Dredze, Frederick Jelinek |
| 2011 | ICWSM | You Are What You Tweet: Analyzing Twitter for Public Health. | Michael J. Paul, Mark Dredze |
| 2010 | COLING | Entity Disambiguation for Knowledge Base Population. | Mark Dredze, Paul McNamee, Delip Rao, Adam Gerber, Tim Finin |
| 2010 | COLING | Streaming Cross Document Entity Coreference Resolution. | Delip Rao, Paul McNamee, Mark Dredze |
| 2010 | EMNLP | NLP on Spoken Documents Without ASR. | Mark Dredze, Aren Jansen, Glen Coppersmith, Ken Ward Church |
| 2010 | EMNLP | We're Not in Kansas Anymore: Detecting Domain Changes in Streams. | Mark Dredze, Tim Oates, Christine D. Piatko |
| 2010 | Interspeech | A spoken term detection framework for recovering out-of-vocabulary words using the web. | Carolina Parada, Abhinav Sethy, Mark Dredze, Frederick Jelinek |
| 2010 | NAACL | Creating Speech and Language Data With Amazon's Mechanical Turk. | Chris Callison-Burch, Mark Dredze |
| 2010 | NAACL | Annotating Named Entities in Twitter Data with Crowdsourcing. | Tim Finin, William Murnane, Anand Karandikar, Nicholas Keller, Justin Martineau, Mark Dredze |
| 2010 | NAACL | Non-Expert Correction of Automatically Generated Relation Annotations. | Matthew R. Gormley, Adam Gerber, Mary P. Harper, Mark Dredze |
| 2010 | NAACL | Contextual Information Improves OOV Detection in Speech. | Carolina Parada, Mark Dredze, Denis Filimonov, Frederick Jelinek |
| 2009 | EMNLP | Multi-Class Confidence Weighted Algorithms. | Koby Crammer, Mark Dredze, Alex Kulesza |
| 2009 | IJCAI | Suggesting Email View Filters for Triage and Search. | Mark Dredze, Bill N. Schilit, Peter Norvig |
| 2008 | AAAI | Intelligent Email: Aiding Users with AI. | Mark Dredze, Hanna M. Wallach, Danny Puller, Tova Brooks, Josh Carroll, Joshua Magarick, John Blitzer, Fernando Pereira |
| 2008 | ACL | Active Learning with Confidence. | Mark Dredze, Koby Crammer |
| 2008 | ACL | Icelandic Data Driven Part of Speech Tagging. | Mark Dredze, Joel Wallenberg |
| 2008 | COLING | Reading the Markets: Forecasting Public Opinion of Political Candidates by News Analysis. | Kevin Lerman, Ari Gilder, Mark Dredze, Fernando Pereira |
| 2008 | EMNLP | Online Methods for Multi-Domain Learning and Adaptation. | Mark Dredze, Koby Crammer |
| 2008 | ICML | Confidence-weighted linear classification. | Mark Dredze, Koby Crammer, Fernando Pereira |
| 2008 | IUI | Intelligent email: reply and attachment prediction. | Mark Dredze, Tova Brooks, Josh Carroll, Joshua Magarick, John Blitzer, Fernando Pereira |
| 2008 | IUI | Generating summary keywords for emails using topics. | Mark Dredze, Hanna M. Wallach, Danny Puller, Fernando Pereira |
| 2007 | ACL | Biographies, Bollywood, Boom-boxes and Blenders: Domain Adaptation for Sentiment Classification. | John Blitzer, Mark Dredze, Fernando Pereira |
| 2007 | EMNLP | Frustratingly Hard Domain Adaptation for Dependency Parsing. | Mark Dredze, John Blitzer, Partha Pratim Talukdar, Kuzman Ganchev, Joo Graa, Fernando C. N. Pereira |
| 2006 | AAAI | Activity-Centric Email: A Machine Learning Approach. | Nicholas Kushmerick, Tessa A. Lau, Mark Dredze, Rinat Khoussainov |
| 2006 | IUI | Automatically classifying emails into activities. | Mark Dredze, Tessa A. Lau, Nicholas Kushmerick |
| 2005 | CHI | Managers' email: beyond tasks and to-dos. | Catalina Danis, Wendy A. Kellogg, Tessa A. Lau, Mark Dredze, Jeffrey Stylos, Nicholas Kushmerick |
| 2003 | IUI | Beyond broadcast. | Kevin Livingston, Mark Dredze, Kristian J. Hammond, Larry Birnbaum |
| 2003 | IUI | Beyond broadcast: a demo. | Kevin Livingston, Mark Dredze, Kristian J. Hammond, Larry Birnbaum |