Sonal Kumar
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
32
Venues
11
Active years
2022–2026
Best venue rank
A*
Where they publish
Papers
32 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | MMAU-Pro: A Challenging and Comprehensive Benchmark for Holistic Evaluation of Audio General Intelligence. | Sonal Kumar, Simon Sedlcek, Vaibhavi Lokegaonkar, Fernando Lpez, Wenyi Yu, Nishit Anand, Hyeonggon Ryu, Lichang Chen, Maxim Plicka, Miroslav Hlavcek, William Fineas Ellingwood, Sathvik Udupa, Siyuan Hou, Allison Ferner, Sara Barahona, Cecilia Bolaos, Satish Rahi, Laura Herrera-Alarcn, Satvik Dixit, Rupali S. Patil, Soham Deshmukh, Lasha Koroshinadze, Yao Liu, Leibny Paola Garca-Perera, Eleni Zanou, Themos Stafylakis, Joon Son Chung, David Harwath, Chao Zhang, Dinesh Manocha, Alicia Lozano-Diez, Santosh Kesiraju, Sreyan Ghosh, Ramani Duraiswami |
| 2026 | ACL | PolyAudio: Advancing Multi-Audio Reasoning in Large Audio Language Models with Interleaved Multi-Audio Contexts. | Sonal Kumar, Sreyan Ghosh, Yueqian Lin, S. Sakshi, Ashish Seth, Yiran Chen, Ramani Duraiswami, Dinesh Manocha |
| 2026 | ICPR | A Fully Unsupervised Framework for Object Mask Labeling with the Self-supervised Vision Transformer. | Sonal Kumar, Kathrotiya Sanket Jitendrabhai, Akshay Daydar, Arijit Sur, Rashmi Dutta Baruah |
| 2025 | EMNLP | MULTIVOX: A Benchmark for Evaluating Voice Assistants for Multimodal Interactions. | Ramaneswaran Selvakumar, Ashish Seth, Nishit Anand, Utkarsh Tyagi, Sonal Kumar, Sreyan Ghosh, Dinesh Manocha |
| 2025 | EMNLP | EGOILLUSION: Benchmarking Hallucinations in Egocentric Video Understanding. | Ashish Seth, Utkarsh Tyagi, Ramaneswaran Selvakumar, Nishit Anand, Sonal Kumar, Sreyan Ghosh, Ramani Duraiswami, Chirag Agarwal, Dinesh Manocha |
| 2025 | ICASSP | ReCLAP: Improving Zero Shot Audio Classification by Describing Sounds. | Sreyan Ghosh, Sonal Kumar, Chandra Kiran Reddy Evuru, Oriol Nieto, Ramani Duraiswami, Dinesh Manocha |
| 2025 | ICASSP | River-GEM: Generating and Enhancing Muddy Water Images. | Alik Pramanick, Chivukula Sairam Satwik, Sonal Kumar, Akshay Daydar, Arijit Sur |
| 2025 | ICLR | Visual Description Grounding Reduces Hallucinations and Boosts Reasoning in LVLMs. | Sreyan Ghosh, Chandra Kiran Reddy Evuru, Sonal Kumar, Utkarsh Tyagi, Oriol Nieto, Zeyu Jin, Dinesh Manocha |
| 2025 | ICLR | Synthio: Augmenting Small-Scale Audio Classification Datasets with Synthetic Data. | Sreyan Ghosh, Sonal Kumar, Zhifeng Kong, Rafael Valle, Bryan Catanzaro, Dinesh Manocha |
| 2025 | ICLR | MMAU: A Massive Multi-Task Audio Understanding and Reasoning Benchmark. | S. Sakshi, Utkarsh Tyagi, Sonal Kumar, Ashish Seth, Ramaneswaran Selvakumar, Oriol Nieto, Ramani Duraiswami, Sreyan Ghosh, Dinesh Manocha |
| 2025 | ICML | Audio Flamingo 2: An Audio-Language Model with Long-Audio Understanding and Expert Reasoning Abilities. | Sreyan Ghosh, Zhifeng Kong, Sonal Kumar, S. Sakshi, Jaehyeon Kim, Wei Ping, Rafael Valle, Dinesh Manocha, Bryan Catanzaro |
| 2025 | NAACL | ProSE: Diffusion Priors for Speech Enhancement. | Sonal Kumar, Sreyan Ghosh, Utkarsh Tyagi, Anton Jeran Ratnarajah, Chandra Kiran Reddy Evuru, Ramani Duraiswami, Dinesh Manocha |
| 2025 | NAACL | Do Audio-Language Models Understand Linguistic Variations? | Ramaneswaran Selvakumar, Sonal Kumar, Hemant Kumar Giri, Nishit Anand, Ashish Seth, Sreyan Ghosh, Dinesh Manocha |
| 2025 | NAACL | PAT: Parameter-Free Audio-Text Aligner to Boost Zero-Shot Audio Classification. | Ashish Seth, Ramaneswaran Selvakumar, Sonal Kumar, Sreyan Ghosh, Dinesh Manocha |
| 2024 | ACL | ASPIRE: Language-Guided Data Augmentation for Improving Robustness Against Spurious Correlations. | Sreyan Ghosh, Chandra Kiran Reddy Evuru, Sonal Kumar, Utkarsh Tyagi, S. Sakshi, Sanjoy Chowdhury, Dinesh Manocha |
| 2024 | ACL | ABEX: Data Augmentation for Low-Resource NLU via Expanding Abstract Descriptions. | Sreyan Ghosh, Utkarsh Tyagi, Sonal Kumar, Chandra Kiran Reddy Evuru, Ramaneswaran S., S. Sakshi, Dinesh Manocha |
| 2024 | CVPR | AV-RIR: Audio-Visual Room Impulse Response Estimation. | Anton Ratnarajah, Sreyan Ghosh, Sonal Kumar, Purva Chiniya, Dinesh Manocha |
| 2024 | EMNLP | GAMA: A Large Audio-Language Model with Advanced Audio Understanding and Complex Reasoning Abilities. | Sreyan Ghosh, Sonal Kumar, Ashish Seth, Chandra Kiran Reddy Evuru, Utkarsh Tyagi, S. Sakshi, Oriol Nieto, Ramani Duraiswami, Dinesh Manocha |
| 2024 | EMNLP | EH-MAM: Easy-to-Hard Masked Acoustic Modeling for Self-Supervised Speech Representation Learning. | Ashish Seth, Ramaneswaran Selvakumar, S. Sakshi, Sonal Kumar, Sreyan Ghosh, Dinesh Manocha |
| 2024 | ICASSP | Recap: Retrieval-Augmented Audio Captioning. | Sreyan Ghosh, Sonal Kumar, Chandra Kiran Reddy Evuru, Ramani Duraiswami, Dinesh Manocha |
| 2024 | ICASSP | IPCL: Iterative Pseudo-Supervised Contrastive Learning to Improve Self-Supervised Feature Representation. | Sonal Kumar, Anirudh Phukan, Arijit Sur |
| 2024 | ICLR | CompA: Addressing the Gap in Compositional Reasoning in Audio-Language Models. | Sreyan Ghosh, Ashish Seth, Sonal Kumar, Utkarsh Tyagi, Chandra Kiran Reddy Evuru, Ramaneswaran S., Sakshi Singh, Oriol Nieto, Ramani Duraiswami, Dinesh Manocha |
| 2024 | ICML | A Closer Look at the Limitations of Instruction Tuning. | Sreyan Ghosh, Chandra Kiran Reddy Evuru, Sonal Kumar, Ramaneswaran S., Deepali Aneja, Zeyu Jin, Ramani Duraiswami, Dinesh Manocha |
| 2024 | ICPR | GraPix: Exploring Graph Modularity Optimization for Unsupervised Pixel Clustering. | Sonal Kumar, Arijit Sur, Rashmi Dutta Baruah |
| 2024 | Interspeech | LipGER: Visually-Conditioned Generative Error Correction for Robust Automatic Speech Recognition. | Sreyan Ghosh, Sonal Kumar, Ashish Seth, Purva Chiniya, Utkarsh Tyagi, Ramani Duraiswami, Dinesh Manocha |
| 2024 | NAACL | CoDa: Constrained Generation based Data Augmentation for Low-Resource NLP. | Chandra Kiran Reddy Evuru, Sreyan Ghosh, Sonal Kumar, Ramaneswaran S., Utkarsh Tyagi, Dinesh Manocha |
| 2024 | NAACL | Do Vision-Language Models Understand Compound Nouns? | Sonal Kumar, Sreyan Ghosh, S. Sakshi, Utkarsh Tyagi, Dinesh Manocha |
| 2023 | ACL | ACLM: A Selective-Denoising based Generative Data Augmentation Approach for Low-Resource Complex NER. | Sreyan Ghosh, Utkarsh Tyagi, Manan Suri, Sonal Kumar, Ramaneswaran S., Dinesh Manocha |
| 2023 | EMNLP | DALE: Generative Data Augmentation for Low-Resource Legal NLP. | Sreyan Ghosh, Chandra Kiran Reddy Evuru, Sonal Kumar, Ramaneswaran S., Sakshi Singh, Utkarsh Tyagi, Dinesh Manocha |
| 2023 | EMNLP | CoSyn: Detecting Implicit Hate Speech in Online Conversations Using a Context Synergized Hyperbolic Network. | Sreyan Ghosh, Manan Suri, Purva Chiniya, Utkarsh Tyagi, Sonal Kumar, Dinesh Manocha |
| 2023 | SIGIR | BioAug: Conditional Generation based Data Augmentation for Low-Resource Biomedical NER. | Sreyan Ghosh, Utkarsh Tyagi, Sonal Kumar, Dinesh Manocha |
| 2022 | Interspeech | Span Classification with Structured Information for Disfluency Detection in Spoken Utterances. | Sreyan Ghosh, Sonal Kumar, Yaman Kumar, Rajiv Ratn Shah, Srinivasan Umesh |