Sunayana Sitaram
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
54
Venues
15
Active years
2012–2026
Best venue rank
A*
Where they publish
Papers
54 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | Exploring Two-Phase Continual Instruction Fine-tuning for Multilingual Adaptation in Large Language Models. | Divyanshu Aggarwal, Sankarshan Damle, Navin Goyal, Satya Lokam, Sunayana Sitaram |
| 2026 | ACL | UPDESH: Synthesizing Grounded Instruction Tuning Data for 13 Indic Languages. | Pranjal A. Chitale, Varun Gumma, Sanchit Ahuja, Prashant Kodali, Manan Uppadhyay, Deepthi Sudharsan, Sunayana Sitaram |
| 2026 | CHI | Building Benchmarks from the Ground Up: Community-Centered Evaluation of LLMs in Healthcare Chatbot Settings. | Hamna, Gayatri Bhat, Sourabrata Mukherjee, Faisal M. Lalani, Evan Hadfield, Divya Siddarth, Kalika Bali, Sunayana Sitaram |
| 2025 | AIES | How Deep Is Representational Bias in LLMs? The Cases of Caste and Religion. | Agrima Seth, Monojit Choudhury, Sunayana Sitaram, Kentaro Toyama, Aditya Vashistha, Kalika Bali |
| 2025 | ASRU | MADASR 2.0: Multi-Lingual Multi-Dialect ASR Challenge in 8 Indian Languages. | Saurabh Kumar, Sumit Sharma, Deekshitha G, Abhayjeet Singh, Amartyaveer, Sathvik Udupa, Sandhya Badiger, Sanjeev Khudanpur, Sunayana Sitaram, Srinivasan Umesh, Bhuvana Ramabhadran, Brian Kingsbury, Hema A. Murthy, Srikanth S. Narayanan, Howard Lakougna, Prasanta Kumar Ghosh |
| 2025 | ASRU | JOOCI: a Novel Method for Learning Comprehensive Speech Representations. | Hemant Yadav, Sunayana Sitaram, Rajiv Ratn Shah |
| 2025 | COLING | Bridging the Language Gap: Dynamic Learning Strategies for Improving Multilingual Performance in LLMs. | Somnath Kumar, Vaibhav Balloli, Mercy Ranjit, Kabir Ahuja, Sunayana Sitaram, Kalika Bali, Tanuja Ganu, Akshay Nambi |
| 2025 | EMNLP | Improving Cross Lingual Transfer by Pretraining with Active Forgetting. | Divyanshu Aggarwal, Ashutosh Sathe, Sunayana Sitaram |
| 2025 | EMNLP | A Multilingual, Culture-First Approach to Addressing Misgendering in LLM Applications. | Sunayana Sitaram, Adrian de Wynter, Isobel McCrum, Qilong Gu, Si-Qing Chen |
| 2025 | NAACL | Improving Consistency in LLM Inference using Probabilistic Tokenization. | Ashutosh Sathe, Divyanshu Aggarwal, Sunayana Sitaram |
| 2024 | ACL | MAPLE: Multilingual Evaluation of Parameter Efficient Finetuning of Large Language Models. | Divyanshu Aggarwal, Ashutosh Sathe, Ishaan Watts, Sunayana Sitaram |
| 2024 | COLING | DOSA: A Dataset of Social Artifacts from Different Indian Geographical Subcultures. | Agrima Seth, Sanchit Ahuja, Kalika Bali, Sunayana Sitaram |
| 2024 | EACL | Are Large Language Model-based Evaluators the Solution to Scaling Up Multilingual Evaluation? | Rishav Hada, Varun Gumma, Adrian de Wynter, Harshita Diddee, Mohamed Ahmed, Monojit Choudhury, Kalika Bali, Sunayana Sitaram |
| 2024 | EACL | MAFIA: Multi-Adapter Fused Inclusive Language Models. | Prachi Jain, Ashutosh Sathe, Varun Gumma, Kabir Ahuja, Sunayana Sitaram |
| 2024 | EMNLP | Teaching LLMs to Abstain across Languages via Multilingual Feedback. | Shangbin Feng, Weijia Shi, Yike Wang, Wenxuan Ding, Orevaoghene Ahia, Shuyue Stella Li, Vidhisha Balachandran, Sunayana Sitaram, Yulia Tsvetkov |
| 2024 | EMNLP | Cultural Conditioning or Placebo? On the Effectiveness of Socio-Demographic Prompting. | Sagnik Mukherjee, Muhammad Farid Adilazuarda, Sunayana Sitaram, Kalika Bali, Alham Fikri Aji, Monojit Choudhury |
| 2024 | EMNLP | A Unified Framework and Dataset for Assessing Societal Bias in Vision-Language Models. | Ashutosh Sathe, Prachi Jain, Sunayana Sitaram |
| 2024 | EMNLP | M5 - A Diverse Benchmark to Assess the Performance of Large Multimodal Models Across Multilingual and Multicultural Vision-Language Tasks. | Florian Schneider, Sunayana Sitaram |
| 2024 | EMNLP | PARIKSHA: A Large-Scale Investigation of Human-LLM Evaluator Agreement on Multilingual and Multi-Cultural Data. | Ishaan Watts, Varun Gumma, Aditya Yadavalli, Vivek Seshadri, Manohar Swaminathan, Sunayana Sitaram |
| 2024 | Interspeech | MS-HuBERT: Mitigating Pre-training and Inference Mismatch in Masked Language Modelling methods for learning Speech Representations. | Hemant Yadav, Sunayana Sitaram, Rajiv Ratn Shah |
| 2024 | NAACL | MEGAVERSE: Benchmarking Large Language Models Across Languages, Modalities, Models and Tasks. | Sanchit Ahuja, Divyanshu Aggarwal, Varun Gumma, Ishaan Watts, Ashutosh Sathe, Millicent Ochieng, Rishav Hada, Prachi Jain, Mohamed Ahmed, Kalika Bali, Sunayana Sitaram |
| 2024 | NAACL | METAL: Towards Multilingual Meta-Evaluation. | Rishav Hada, Varun Gumma, Mohamed Ahmed, Kalika Bali, Sunayana Sitaram |
| 2023 | ACL | A Comparative Study on the Impact of Model Compression Techniques on Fairness in Language Models. | Krithika Ramesh, Arnav Chavan, Shrey Pandit, Sunayana Sitaram |
| 2023 | ACL | On Evaluating and Mitigating Gender Biases in Multilingual Settings. | Aniket Vashishtha, Kabir Ahuja, Sunayana Sitaram |
| 2023 | ASRU | Partial Rank Similarity Minimization Method for Quality MOS Prediction of Unseen Speech Synthesis Systems in Zero-Shot and Semi-Supervised Setting. | Hemant Yadav, Erica Cooper, Junichi Yamagishi, Sunayana Sitaram, Rajiv Ratn Shah |
| 2023 | EACL | DiTTO: A Feature Representation Imitation Approach for Improving Cross-Lingual Transfer. | Shanu Kumar, Abbaraju Soujanya, Sandipan Dandapat, Sunayana Sitaram, Monojit Choudhury |
| 2023 | EACL | Fairness in Language Models Beyond English: Gaps and Challenges. | Krithika Ramesh, Sunayana Sitaram, Monojit Choudhury |
| 2023 | EACL | Performance and Risk Trade-offs for Multi-word Text Prediction at Scale. | Aniket Vashishtha, S. Sai Prasad, Payal Bajaj, Vishrav Chaudhary, Kate Cook, Sandipan Dandapat, Sunayana Sitaram, Monojit Choudhury |
| 2023 | EMNLP | MEGA: Multilingual Evaluation of Generative AI. | Kabir Ahuja, Harshita Diddee, Rishav Hada, Millicent Ochieng, Krithika Ramesh, Prachi Jain, Akshay Uttama Nambi, Tanuja Ganu, Sameer Segal, Mohamed Ahmed, Kalika Bali, Sunayana Sitaram |
| 2023 | EMNLP | Representativeness as a Forgotten Lesson for Multilingual and Code-switched Data Collection and Preparation. | A. Seza Dogruz, Sunayana Sitaram, Zheng Xin Yong |
| 2023 | ICASSP | Analysing the Masked Predictive Coding Training Criterion for Pre-Training a Speech Representation Model. | Hemant Yadav, Sunayana Sitaram, Rajiv Ratn Shah |
| 2022 | AAAI | LITMUS Predictor: An AI Assistant for Building Reliable, High-Performing and Fair Multilingual NLP Systems. | Anirudh Srinivasan, Gauri Kholkar, Rahul Kejriwal, Tanuja Ganu, Sandipan Dandapat, Sunayana Sitaram, Balakrishnan Santhanam, Somak Aditya, Kalika Bali, Monojit Choudhury |
| 2022 | EMNLP | On the Calibration of Massively Multilingual Language Models. | Kabir Ahuja, Sunayana Sitaram, Sandipan Dandapat, Monojit Choudhury |
| 2022 | IJCNLP | Multilingual CheckList: Generation and Evaluation. | Karthikeyan K, Shaily Bhatt, Pankaj Singh, Somak Aditya, Sandipan Dandapat, Sunayana Sitaram, Monojit Choudhury |
| 2022 | LREC | A Survey of Multilingual Models for Automatic Speech Recognition. | Hemant Yadav, Sunayana Sitaram |
| 2021 | ACL | A Survey of Code-switching: Linguistic and Social Perspectives for Language Technologies. | A. Seza Dogruz, Sunayana Sitaram, Barbara E. Bullock, Almeida Jacqueline Toribio |
| 2021 | EACL | GCM: A Toolkit for Generating Synthetic Code-mixed Text. | Mohd Sanad Zaki Rizvi, Anirudh Srinivasan, Tanuja Ganu, Monojit Choudhury, Sunayana Sitaram |
| 2021 | Interspeech | MUCS 2021: Multilingual and Code-Switching ASR Challenges for Low Resource Indian Languages. | Anuj Diwan, Rakesh Vaideeswaran, Sanket Shah, Ankita Singh, Srinivasa Raghavan K. M., Shreya Khare, Vinit Unni, Saurabh Vyas, Akash Rajpuria, Chiranjeevi Yarra, Ashish R. Mittal, Prasanta Kumar Ghosh, Preethi Jyothi, Kalika Bali, Vivek Seshadri, Sunayana Sitaram, Samarth Bharadwaj, Jai Nanavati, Raoul Nanavati, Karthik Sankaranarayanan |
| 2020 | ACL | GLUECoS: An Evaluation Benchmark for Code-Switched NLP. | Simran Khanuja, Sandipan Dandapat, Anirudh Srinivasan, Sunayana Sitaram, Monojit Choudhury |
| 2020 | LREC | Crowdsourcing Speech Data for Low-Resource Languages from Low-Income Workers. | Basil Abraham, Danish Goel, Divya Siddarth, Kalika Bali, Manu Chopra, Monojit Choudhury, Pratik Joshi, Preethi Jyothi, Sunayana Sitaram, Vivek Seshadri |
| 2019 | ICDM | Using Monolingual Speech Recognition for Spoken Term Detection in Code-switched Hindi-English Speech. | Sanket Shah, Sunayana Sitaram |
| 2018 | ACL | Language Modeling for Code-Mixing: The Role of Linguistic Theory based Synthetic Data. | Adithya Pratapa, Gayatri Bhat, Monojit Choudhury, Sunayana Sitaram, Sandipan Dandapat, Kalika Bali |
| 2018 | EMNLP | Word Embeddings for Code-Mixed Language Processing. | Adithya Pratapa, Monojit Choudhury, Sunayana Sitaram |
| 2018 | Interspeech | Effect of TTS Generated Audio on OOV Detection and Word Error Rate in ASR for Low-resource Languages. | Savitha Murthy, Dinkar Sitaram, Sunayana Sitaram |
| 2018 | Interspeech | Homophone Identification and Merging for Code-switched Speech Recognition. | Brij Mohan Lal Srivastava, Sunayana Sitaram |
| 2018 | LREC | Discovering Canonical Indian English Accents: A Crowdsourcing-based Approach. | Sunayana Sitaram, Varun Manjunath, Varun Bharadwaj, Monojit Choudhury, Kalika Bali, Michael Tjalve |
| 2017 | Interspeech | Speech Synthesis for Mixed-Language Navigation Instructions. | Khyathi Raghavi Chandu, Sai Krishna Rallabandi, Sunayana Sitaram, Alan W. Black |
| 2016 | LREC | Speech Synthesis of Code-Mixed Text. | Sunayana Sitaram, Alan W. Black |
| 2016 | NAACL | Polyglot Neural Language Models: A Case Study in Cross-Lingual Phonetic Representation Learning. | Yulia Tsvetkov, Sunayana Sitaram, Manaal Faruqui, Guillaume Lample, Patrick Littell, David R. Mortensen, Alan W. Black, Lori S. Levin, Chris Dyer |
| 2015 | Interspeech | Using articulatory features and inferred phonological segments in zero resource speech processing. | Pallavi Baljekar, Sunayana Sitaram, Prasanna Kumar Muthukumar, Alan W. Black |
| 2015 | Interspeech | Using acoustics to improve pronunciation for synthesis of low resource languages. | Sunayana Sitaram, Serena Jeblee, Alan W. Black |
| 2015 | Interspeech | Universal grapheme-based speech synthesis. | Sunayana Sitaram, Alok Parlikar, Gopala Krishna Anumanchipalli, Alan W. Black |
| 2013 | ICASSP | Bootstrapping Text-to-Speech for speech processing in languages without an orthography. | Sunayana Sitaram, Sukhada Palkar, Yun-Nung Chen, Alok Parlikar, Alan W. Black |
| 2012 | FlAIRS | Mining Data from Project LISTEN's Reading Tutor to Analyze Development of Children's Oral Reading Prosody. | Sunayana Sitaram, Jack Mostow |