Soham Deshmukh
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
17
Venues
5
Active years
2021–2026
Best venue rank
A*
Where they publish
Papers
17 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | MMAU-Pro: A Challenging and Comprehensive Benchmark for Holistic Evaluation of Audio General Intelligence. | Sonal Kumar, Simon Sedlcek, Vaibhavi Lokegaonkar, Fernando Lpez, Wenyi Yu, Nishit Anand, Hyeonggon Ryu, Lichang Chen, Maxim Plicka, Miroslav Hlavcek, William Fineas Ellingwood, Sathvik Udupa, Siyuan Hou, Allison Ferner, Sara Barahona, Cecilia Bolaos, Satish Rahi, Laura Herrera-Alarcn, Satvik Dixit, Rupali S. Patil, Soham Deshmukh, Lasha Koroshinadze, Yao Liu, Leibny Paola Garca-Perera, Eleni Zanou, Themos Stafylakis, Joon Son Chung, David Harwath, Chao Zhang, Dinesh Manocha, Alicia Lozano-Diez, Santosh Kesiraju, Sreyan Ghosh, Ramani Duraiswami |
| 2025 | AAAI | Audio Entailment: Assessing Deductive Reasoning for Audio Understanding. | Soham Deshmukh, Shuo Han, Hazim T. Bukhari, Benjamin Elizalde, Hannes Gamper, Rita Singh, Bhiksha Raj |
| 2025 | ASRU | CoLMbo: Speaker Language Model for Descriptive Profiling. | Massa Baali, Shuo Han, Syed Abdul Hannan, Purusottam Samal, Karanveer Singh, Soham Deshmukh, Rita Singh, Bhiksha Raj |
| 2025 | ICASSP | MACE: Leveraging Audio for Evaluating Audio Captioning Systems. | Satvik Dixit, Soham Deshmukh, Bhiksha Raj |
| 2025 | ICLR | ADIFF: Explaining audio difference using natural language. | Soham Deshmukh, Shuo Han, Rita Singh, Bhiksha Raj |
| 2024 | ICASSP | Training Audio Captioning Models without Audio. | Soham Deshmukh, Benjamin Elizalde, Dimitra Emmanouilidou, Bhiksha Raj, Rita Singh, Huaming Wang |
| 2024 | ICASSP | Prompting Audios Using Acoustic Properties for Emotion Representation. | Hira Dhamyal, Benjamin Elizalde, Soham Deshmukh, Huaming Wang, Bhiksha Raj, Rita Singh |
| 2024 | ICASSP | Natural Language Supervision For General-Purpose Audio Representations. | Benjamin Elizalde, Soham Deshmukh, Huaming Wang |
| 2024 | Interspeech | SELM: Enhancing Speech Emotion Recognition for Out-of-Domain Scenarios. | Hazim T. Bukhari, Soham Deshmukh, Hira Dhamyal, Bhiksha Raj, Rita Singh |
| 2024 | Interspeech | PAM: Prompting Audio-Language Models for Audio Quality Assessment. | Soham Deshmukh, Dareen Alharthi, Benjamin Elizalde, Hannes Gamper, Mahmoud Al Ismail, Rita Singh, Bhiksha Raj, Huaming Wang |
| 2024 | Interspeech | Domain Adaptation for Contrastive Audio-Language Models. | Soham Deshmukh, Rita Singh, Bhiksha Raj |
| 2023 | ICASSP | CLAP Learning Audio Concepts from Natural Language Supervision. | Benjamin Elizalde, Soham Deshmukh, Mahmoud Al Ismail, Huaming Wang |
| 2023 | ICASSP | Multi-View Learning for Speech Emotion Recognition with Categorical Emotion, Categorical Sentiment, and Dimensional Scores. | Daniel Tompkins, Dimitra Emmanouilidou, Soham Deshmukh, Benjamin Elizalde |
| 2023 | Interspeech | Audio Retrieval with WavText5K and CLAP Training. | Soham Deshmukh, Benjamin Elizalde, Huaming Wang |
| 2021 | ICASSP | Interpreting Glottal Flow Dynamics for Detecting Covid-19 From Voice. | Soham Deshmukh, Mahmoud Al Ismail, Rita Singh |
| 2021 | ICASSP | Detection of Covid-19 Through the Analysis of Vocal Fold Oscillations. | Mahmoud Al Ismail, Soham Deshmukh, Rita Singh |
| 2021 | Interspeech | Improving Weakly Supervised Sound Event Detection with Self-Supervised Auxiliary Tasks. | Soham Deshmukh, Bhiksha Raj, Rita Singh |