| 2026 | EACL | CAIRE: Cultural Attribution of Images with Retrieval. | Arnav Yayavaram, Siddharth Yayavaram, Simran Khanuja, Michael Saxon, Graham Neubig |
| 2025 | ACL | Can Vision Language Models Understand Mimed Actions? | Hyundong Justin Cho, Spencer Lin, Tejas Srinivasan, Michael Saxon, Deuksin Kwon, Natali T. Chavez, Jonathan May |
| 2025 | ACL | TC-Bench: Benchmarking Temporal Compositionality in Conditional Video Generation. | Weixi Feng, Jiachen Li, Michael Saxon, Tsu-Jui Fu, Wenhu Chen, William Yang Wang |
| 2025 | EMNLP | Culture is Everywhere: A Call for Intentionally Cultural Evaluation. | Juhyun Oh, Inha Cha, Michael Saxon, Hyunseung Lim, Shaily Bhatt, Alice Oh |
| 2025 | EMNLP | Do You Know About My Nation? Investigating Multilingual Language Models' Cultural Literacy Through Factual Knowledge. | Eshaan Tanwar, Anwoy Chatterjee, Michael Saxon, Alon Albalak, William Yang Wang, Tanmoy Chakraborty |
| 2025 | ICCV | VSP: Diagnosing the Dual Challenges of Perception and Reasoning in Spatial Planning Tasks for MLLMS. | Qiucheng Wu, Handong Zhao, Michael Saxon, Trung Bui, William Yang Wang, Yang Zhang, Shiyu Chang |
| 2024 | EMNLP | Losing Visual Needles in Image Haystacks: Vision Language Models are Easily Distracted in Short and Long Contexts. | Aditya Sharma, Michael Saxon, William Yang Wang |
| 2024 | NAACL | Lost in Translation? Translation Errors and Challenges for Fair Assessment of Text-to-Image Models on Multilingual Concepts. | Michael Saxon, Yiran Luo, Sharon Levy, Chitta Baral, Yezhou Yang, William Yang Wang |
| 2023 | ACL | Multilingual Conceptual Coverage in Text-to-Image Models. | Michael Saxon, William Yang Wang |
| 2023 | ACL | CausalDialogue: Modeling Utterance-level Causality in Conversations. | Yi-Lin Tuan, Alon Albalak, Wenda Xu, Michael Saxon, Connor Pryor, Lise Getoor, William Yang Wang |
| 2023 | EACL | PECO: Examining Single Sentence Label Leakage in Natural Language Inference Datasets through Progressive Evaluation of Cluster Outliers. | Michael Saxon, Xinyi Wang, Wenda Xu, William Yang Wang |
| 2023 | EMNLP | Let's Think Frame by Frame with VIP: A Video Infilling and Prediction Dataset for Evaluating Video Chain-of-Thought. | Vaishnavi Himakunthala, Andy Ouyang, Daniel Rose, Ryan He, Alex Mei, Yujie Lu, Chinmay Sonar, Michael Saxon, William Yang Wang |
| 2023 | ICLR | WikiWhy: Answering and Explaining Cause-and-Effect Questions. | Matthew Ho, Aditya Sharma, Justin Chang, Michael Saxon, Sharon Levy, Yujie Lu, William Yang Wang |
| 2023 | ICLR | Causal Balancing for Domain Generalization. | Xinyi Wang, Michael Saxon, Jiachen Li, Hongyang Zhang, Kun Zhang, William Yang Wang |
| 2023 | Interspeech | Data Augmentation for Diverse Voice Conversion in Noisy Environments. | Avani Tanna, Michael Saxon, Amr El Abbadi, William Yang Wang |
| 2022 | AAAI | Self-Supervised Knowledge Assimilation for Expert-Layman Text Style Transfer. | Wenda Xu, Michael Saxon, Misha Sra, William Yang Wang |
| 2022 | EMNLP | Not All Errors are Equal: Learning Text Generation Metrics using Stratified Error Synthesis. | Wenda Xu, Yi-Lin Tuan, Yujie Lu, Michael Saxon, Lei Li, William Yang Wang |
| 2021 | ACL | Investigating Memorization of Conspiracy Theories in Text Generation. | Sharon Levy, Michael Saxon, William Yang Wang |
| 2021 | EMNLP | Modeling Disclosive Transparency in NLP Application Descriptions. | Michael Saxon, Sharon Levy, Xinyi Wang, Alon Albalak, William Yang Wang |
| 2021 | Interspeech | End-to-End Spoken Language Understanding for Generalized Voice Assistants. | Michael Saxon, Samridhi Choudhary, Joseph P. McKenna, Athanasios Mouchtaris |
| 2020 | Interspeech | Semantic Complexity in End-to-End Spoken Language Understanding. | Joseph P. McKenna, Samridhi Choudhary, Michael Saxon, Grant P. Strimel, Athanasios Mouchtaris |
| 2020 | Interspeech | UncommonVoice: A Crowdsourced Dataset of Dysphonic Speech. | Meredith Moore, Piyush Papreja, Michael Saxon, Visar Berisha, Sethuraman Panchanathan |
| 2019 | AAAI | Word Pair Convolutional Model for Happy Moment Classification. | Michael Saxon, Samarth Bhandari, Lewis Ruskin, Gabrielle Honda |
| 2019 | ICASSP | Objective Measures of Plosive Nasalization in Hypernasal Speech. | Michael Saxon, Julie Liss, Visar Berisha |
| 2019 | Interspeech | Say What? A Dataset for Exploring the Error Patterns That Two ASR Engines Make. | Meredith Moore, Michael Saxon, Hemanth Venkateswara, Visar Berisha, Sethuraman Panchanathan |
| 2018 | HCI | Chat-Box: Proposing a Mood Analyzer for Individuals with Social Interaction Disabilities. | Bineeta Gupta, Michael Saxon, Troy McDaniel, Sethuraman Panchanathan |