Skip to content

Soham Deshmukh

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

17

Venues

5

Active years

2021–2026

Best venue rank

A*

Where they publish

Papers

17 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIMMAU-Pro: A Challenging and Comprehensive Benchmark for Holistic Evaluation of Audio General Intelligence.Sonal Kumar, Simon Sedlcek, Vaibhavi Lokegaonkar, Fernando Lpez, Wenyi Yu, Nishit Anand, Hyeonggon Ryu, Lichang Chen, Maxim Plicka, Miroslav Hlavcek, William Fineas Ellingwood, Sathvik Udupa, Siyuan Hou, Allison Ferner, Sara Barahona, Cecilia Bolaos, Satish Rahi, Laura Herrera-Alarcn, Satvik Dixit, Rupali S. Patil, Soham Deshmukh, Lasha Koroshinadze, Yao Liu, Leibny Paola Garca-Perera, Eleni Zanou, Themos Stafylakis, Joon Son Chung, David Harwath, Chao Zhang, Dinesh Manocha, Alicia Lozano-Diez, Santosh Kesiraju, Sreyan Ghosh, Ramani Duraiswami
2025AAAIAudio Entailment: Assessing Deductive Reasoning for Audio Understanding.Soham Deshmukh, Shuo Han, Hazim T. Bukhari, Benjamin Elizalde, Hannes Gamper, Rita Singh, Bhiksha Raj
2025ASRUCoLMbo: Speaker Language Model for Descriptive Profiling.Massa Baali, Shuo Han, Syed Abdul Hannan, Purusottam Samal, Karanveer Singh, Soham Deshmukh, Rita Singh, Bhiksha Raj
2025ICASSPMACE: Leveraging Audio for Evaluating Audio Captioning Systems.Satvik Dixit, Soham Deshmukh, Bhiksha Raj
2025ICLRADIFF: Explaining audio difference using natural language.Soham Deshmukh, Shuo Han, Rita Singh, Bhiksha Raj
2024ICASSPTraining Audio Captioning Models without Audio.Soham Deshmukh, Benjamin Elizalde, Dimitra Emmanouilidou, Bhiksha Raj, Rita Singh, Huaming Wang
2024ICASSPPrompting Audios Using Acoustic Properties for Emotion Representation.Hira Dhamyal, Benjamin Elizalde, Soham Deshmukh, Huaming Wang, Bhiksha Raj, Rita Singh
2024ICASSPNatural Language Supervision For General-Purpose Audio Representations.Benjamin Elizalde, Soham Deshmukh, Huaming Wang
2024InterspeechSELM: Enhancing Speech Emotion Recognition for Out-of-Domain Scenarios.Hazim T. Bukhari, Soham Deshmukh, Hira Dhamyal, Bhiksha Raj, Rita Singh
2024InterspeechPAM: Prompting Audio-Language Models for Audio Quality Assessment.Soham Deshmukh, Dareen Alharthi, Benjamin Elizalde, Hannes Gamper, Mahmoud Al Ismail, Rita Singh, Bhiksha Raj, Huaming Wang
2024InterspeechDomain Adaptation for Contrastive Audio-Language Models.Soham Deshmukh, Rita Singh, Bhiksha Raj
2023ICASSPCLAP Learning Audio Concepts from Natural Language Supervision.Benjamin Elizalde, Soham Deshmukh, Mahmoud Al Ismail, Huaming Wang
2023ICASSPMulti-View Learning for Speech Emotion Recognition with Categorical Emotion, Categorical Sentiment, and Dimensional Scores.Daniel Tompkins, Dimitra Emmanouilidou, Soham Deshmukh, Benjamin Elizalde
2023InterspeechAudio Retrieval with WavText5K and CLAP Training.Soham Deshmukh, Benjamin Elizalde, Huaming Wang
2021ICASSPInterpreting Glottal Flow Dynamics for Detecting Covid-19 From Voice.Soham Deshmukh, Mahmoud Al Ismail, Rita Singh
2021ICASSPDetection of Covid-19 Through the Analysis of Vocal Fold Oscillations.Mahmoud Al Ismail, Soham Deshmukh, Rita Singh
2021InterspeechImproving Weakly Supervised Sound Event Detection with Self-Supervised Auxiliary Tasks.Soham Deshmukh, Bhiksha Raj, Rita Singh