| 2026 | ACL | Faithfulness vs. Safety: Evaluating LLM Behavior Under Counterfactual Medical Evidence. | Kaijie Mo, Siddhartha Venkatayogi, Chantal Shaib, Ramez Kouzy, Wei Xu, Byron C. Wallace, Junyi Jessy Li |
| 2025 | ACL | Who Taught You That? Tracing Teachers in Model Distillation. | Somin Wadhwa, Chantal Shaib, Silvio Amir, Byron C. Wallace |
| 2025 | EMNLP | Measuring Lexical Diversity of Synthetic Data Generated through Fine-Grained Persona Prompting. | Gauri Kambhatla, Chantal Shaib, Venkata Govindarajan |
| 2024 | EMNLP | Detection and Measurement of Syntactic Templates in Generated Text. | Chantal Shaib, Yanai Elazar, Junyi Jessy Li, Byron C. Wallace |
| 2024 | ICLR | Evaluating the Zero-shot Robustness of Instruction-tuned Language Models. | Jiuding Sun, Chantal Shaib, Byron C. Wallace |
| 2023 | ACL | Summarizing, Simplifying, and Synthesizing Medical Evidence using GPT-3 (with Varying Success). | Chantal Shaib, Millicent L. Li, Sebastian Joseph, Iain James Marshall, Junyi Jessy Li, Byron C. Wallace |
| 2020 | EMNLP | Explainable Clinical Decision Support from Text. | Jinyue Feng, Chantal Shaib, Frank Rudzicz |