| 2026 | ACL | ModeX: Evaluator-Free Best-of-N Selection for Open-Ended Generation. | Hyeong Kyu Choi, Sharon Li |
| 2026 | ACL | When Identity Skews Debate: Anonymization for Bias-Reduced Multi-Agent Reasoning. | Hyeong Kyu Choi, Xiaojin (Jerry) Zhu, Sharon Li |
| 2026 | ACL | GeoArena: Evaluating Open-World Geographic Reasoning in Large Vision-Language Models. | Pengyue Jia, Yingyi Zhang, Xiangyu Zhao, Sharon Li |
| 2026 | ACL | LAD: Learning Advantage Distribution for Reasoning. | Wendi Li, Sharon Li |
| 2026 | ACL | Uncertainty Quantification in LLM Agents: Foundations, Emerging Challenges, and Opportunities. | Changdae Oh, Seongheon Park, To Eun Kim, Jiatong Li, Wendi Li, Samuel Yeh, Sean Du, Hamed Hassani, Paul Bogdan, Dawn Song, Sharon Li |
| 2026 | ACL | VAUQ: Vision-Aware Uncertainty Quantification for LVLM Self-Evaluation. | Seongheon Park, Changdae Oh, Hyeong Kyu Choi, Sean Du, Sharon Li |
| 2026 | ACL | Why Multimodal In-Context Learning Lags Behind? Unveiling the Inner Mechanisms and Bottlenecks. | Yu Wang, Sharon Li |
| 2026 | ACL | How Retrieved Context Shapes Internal Representations in RAG. | Samuel Yeh, Sharon Li |
| 2024 | WWW | DCAI: Data-centric Artificial Intelligence. | Wei Jin, Haohan Wang, Daochen Zha, Qiaoyu Tan, Yao Ma, Sharon Li, Su-In Lee |
| 2021 | ICLR | Model Patching: Closing the Subgroup Performance Gap with Data Augmentation. | Karan Goel, Albert Gu, Sharon Li, Christopher R |