| 2026 | CHI | Building Benchmarks from the Ground Up: Community-Centered Evaluation of LLMs in Healthcare Chatbot Settings. | Hamna, Gayatri Bhat, Sourabrata Mukherjee, Faisal M. Lalani, Evan Hadfield, Divya Siddarth, Kalika Bali, Sunayana Sitaram |
| 2025 | EMNLP | Women, Infamous, and Exotic Beings: A Comparative Study of Honorific Usages in Wikipedia and LLMs for Bengali and Hindi. | Sourabrata Mukherjee, Atharva Mehta, Sougata Saha, Akhil Arora, Monojit Choudhury |
| 2025 | NAACL | Evaluating Text Style Transfer Evaluation: Are There Any Reliable Metrics? | Sourabrata Mukherjee, Atul Kr. Ojha, John Philip McCrae, Ondrej Dusek |
| 2024 | INLG | Multilingual Text Style Transfer: Datasets & Models for Indian Languages. | Sourabrata Mukherjee, Atul Kr. Ojha, Akanksha Bansal, Deepak Alok, John P. McCrae, Ondrej Dusek |
| 2024 | INLG | Are Large Language Models Actually Good at Text Style Transfer? | Sourabrata Mukherjee, Atul Kr. Ojha, Ondrej Dusek |
| 2023 | EACL | Polite Chatbot: A Text Style Transfer Application. | Sourabrata Mukherjee, Vojtech Hudecek, Ondrej Dusek |
| 2023 | INLG | Leveraging Low-resource Parallel Data for Text Style Transfer. | Sourabrata Mukherjee, Ondrej Dusek |