| 2025 | AAAI | Audio Entailment: Assessing Deductive Reasoning for Audio Understanding. | Soham Deshmukh, Shuo Han, Hazim T. Bukhari, Benjamin Elizalde, Hannes Gamper, Rita Singh, Bhiksha Raj |
| 2024 | ICASSP | Training Audio Captioning Models without Audio. | Soham Deshmukh, Benjamin Elizalde, Dimitra Emmanouilidou, Bhiksha Raj, Rita Singh, Huaming Wang |
| 2024 | ICASSP | Prompting Audios Using Acoustic Properties for Emotion Representation. | Hira Dhamyal, Benjamin Elizalde, Soham Deshmukh, Huaming Wang, Bhiksha Raj, Rita Singh |
| 2024 | ICASSP | Natural Language Supervision For General-Purpose Audio Representations. | Benjamin Elizalde, Soham Deshmukh, Huaming Wang |
| 2024 | Interspeech | PAM: Prompting Audio-Language Models for Audio Quality Assessment. | Soham Deshmukh, Dareen Alharthi, Benjamin Elizalde, Hannes Gamper, Mahmoud Al Ismail, Rita Singh, Bhiksha Raj, Huaming Wang |
| 2023 | ICASSP | CLAP Learning Audio Concepts from Natural Language Supervision. | Benjamin Elizalde, Soham Deshmukh, Mahmoud Al Ismail, Huaming Wang |
| 2023 | ICASSP | Multi-View Learning for Speech Emotion Recognition with Categorical Emotion, Categorical Sentiment, and Dimensional Scores. | Daniel Tompkins, Dimitra Emmanouilidou, Soham Deshmukh, Benjamin Elizalde |
| 2023 | Interspeech | Audio Retrieval with WavText5K and CLAP Training. | Soham Deshmukh, Benjamin Elizalde, Huaming Wang |
| 2020 | ICASSP | Multi-Label Sound Event Retrieval Using A Deep Learning-Based Siamese Structure With A Pairwise Presence Matrix. | Jianyu Fan, Eric Nichols, Daniel Tompkins, Ana Elisa Mndez Mndez, Benjamin Elizalde, Philippe Pasquier |
| 2019 | ICASSP | Cross Modal Audio Search and Retrieval with Joint Embeddings Based on Text and Audio. | Benjamin Elizalde, Shuayb Zarar, Bhiksha Raj |
| 2018 | ICASSP | Framework for Evaluation of Sound Event Detection in Web Videos. | Rohan Badlani, Ankit Shah, Benjamin Elizalde, Anurag Kumar, Bhiksha Raj |
| 2018 | ICASSP | Acoustic Scene Classification Using Discrete Random Hashing for Laplacian Kernel Machines. | Abelino Jimenez, Benjamin Elizalde, Bhiksha Raj |
| 2018 | ICASSP | Content-Based Representations of Audio Using Siamese Neural Networks. | Pranay Manocha, Rohan Badlani, Anurag Kumar, Ankit Shah, Benjamin Elizalde, Bhiksha Raj |
| 2017 | Interspeech | Audio Content Based Geotagging in Multimedia. | Anurag Kumar, Benjamin Elizalde, Bhiksha Raj |
| 2014 | Interspeech | Audio-concept features and hidden Markov models for multimedia event detection. | Benjamin Elizalde, Mirco Ravanelli, Karl Ni, Damian Borth, Gerald Friedland |
| 2013 | Interspeech | Audio Concept Ranking for Video Event Detection on User-Generated Content. | Benjamin Elizalde, Mirco Ravanelli, Gerald Friedland |
| 2013 | ISM | An i-Vector Representation of Acoustic Environments for Audio-Based Video Event Detection on User Generated Content. | Benjamin Elizalde, Howard Lei, Gerald Friedland |