| 2025 | ICASSP | SoloAudio: Target Sound Extraction with Language-oriented Audio Diffusion Transformer. | Helin Wang, Jiarui Hai, Yen-Ju Lu, Karan Thakkar, Mounya Elhilali, Najim Dehak |
| 2025 | Interspeech | EzAudio: Enhancing Text-to-Audio Generation with Efficient Diffusion Transformer. | Jiarui Hai, Yong Xu, Hao Zhang, Chenxing Li, Helin Wang, Mounya Elhilali, Dong Yu |
| 2024 | ICASSP | DPM-TSE: A Diffusion Probabilistic Model for Target Sound Extraction. | Jiarui Hai, Helin Wang, Dongchao Yang, Karan Thakkar, Najim Dehak, Mounya Elhilali |
| 2024 | ICASSP | Biomimetic Mappings for Active Sonar Object Recognition in Clutter. | Sangwook Park, Angeles Salles, Kathryne Allen, Cynthia F. Moss, Mounya Elhilali |
| 2024 | ICASSP | Investigating Self-Supervised Deep Representations for EEG-Based Auditory Attention Decoding. | Karan Thakkar, Jiarui Hai, Mounya Elhilali |
| 2024 | Interspeech | DreamVoice: Text-Guided Voice Conversion. | Jiarui Hai, Karan Thakkar, Helin Wang, Zengyi Qin, Mounya Elhilali |
| 2023 | ASRU | Boosting Modality Representation With Pre-Trained Models and Multi-Task Training for Multimodal Sentiment Analysis. | Jiarui Hai, Yu-Jeh Liu, Mounya Elhilali |
| 2022 | ICASSP | Temporal Contrastive-Loss for Audio Event Detection. | Sandeep Kothinti, Mounya Elhilali |
| 2022 | ICASSP | Time-Balanced Focal Loss for Audio Event Detection. | Sangwook Park, Mounya Elhilali |
| 2022 | Interspeech | Temporal coding with magnitude-phase regularization for sound event detection. | Sangwook Park, Sandeep Reddy Kothinti, Mounya Elhilali |
| 2021 | ICASSP | Self-Training for Sound Event Detection in Audio Mixtures. | Sangwook Park, Ashwin Bellur, David K. Han, Mounya Elhilali |
| 2021 | Interspeech | Adaptive Listening to Everyday Soundscapes. | Mounya Elhilali |
| 2020 | ICASSP | Bio-Mimetic Attentional Feedback in Music Source Separation. | Ashwin Bellur, Mounya Elhilali |
| 2020 | ICASSP | Synthesizing Engaging Music Using Dynamic Models of Statistical Surprisal. | Sandeep Kothinti, Benjamin Skerritt-Davis, Aditya Nair, Mounya Elhilali |
| 2019 | ICASSP | Joint Acoustic and Class Inference for Weakly Supervised Sound Event Detection. | Sandeep Kothinti, Keisuke Imoto, Debmalya Chakrabarty, Gregory Sell, Shinji Watanabe, Mounya Elhilali |
| 2019 | Interspeech | A Study of a Cross-Language Perception Based on Cortical Analysis Using Biomimetic STRFs. | Sangwook Park, David K. Han, Mounya Elhilali |
| 2018 | ICASSP | Sensory Mapping Adaptation Under Multiple Task Scenarios. | Ashwin Bellur, Mounya Elhilali |
| 2016 | ICASSP | Abnormal sound event detection using temporal trajectories mixtures. | Debmalya Chakrabarty, Mounya Elhilali |
| 2015 | CISS | Detection of speech tokens in noise using adaptive spectrotemporal receptive fields. | Ashwin Bellur, Mounya Elhilali |
| 2015 | CISS | Modeling goal-directed attention in tone sequences using a weighted Kalman filter. | Debmalya Chakrabarty, Mounya Elhilali |
| 2013 | CISS | Predictive analysis of two tone stream segregation via extended Kalman filter. | Debmalya Chakrabarty, Mounya Elhilali |
| 2013 | CISS | A model of auditory deviance detection. | Emine Merve Kaya, Mounya Elhilali |
| 2013 | ICASSP | Task-driven attentional mechanisms for auditory scene recognition. | Kailash Patil, Mounya Elhilali |
| 2012 | CISS | A temporal saliency map for modeling auditory attention. | Emine Merve Kaya, Mounya Elhilali |
| 2012 | ICASSP | The UMD-JHU 2011 speaker recognition system. | Daniel Garcia-Romero, Xinhui Zhou, Dmitry N. Zotkin, Balaji Vasan Srinivasan, Yuancheng Luo, Sriram Ganapathy, Samuel Thomas, Sridhar Krishna Nemala, Garimella S. V. S. Sivaram, Majid Mirbagheri, Sri Harish Reddy Mallidi, Thomas Janu, Padmanabhan Rajan, Nima Mesgarani, Mounya Elhilali, Hynek Hermansky, Shihab A. Shamma, Ramani Duraiswami |
| 2012 | ICASSP | Multilevel speech intelligibility for robust speaker recognition. | Sridhar Krishna Nemala, Mounya Elhilali |
| 2012 | ICASSP | A model of attention-driven scene analysis. | Malcolm Slaney, Trevor Agus, Shih-Chii Liu, Emine Merve Kaya, Mounya Elhilali |
| 2012 | Interspeech | Robust phoneme recognition based on biomimetic speech contours. | Michael A. Carlin, Kailash Patil, Sridhar Krishna Nemala, Mounya Elhilali |
| 2012 | Interspeech | Goal-Oriented Auditory Scene Recognition. | Kailash Patil, Mounya Elhilali |
| 2011 | CISS | Exploiting temporal coherence in speech for data-driven feature extraction. | Michael A. Carlin, Mounya Elhilali |
| 2011 | CISS | Multistream robust speaker recognition based on speech intelligibility. | Sridhar Krishna Nemala, Mounya Elhilali |
| 2011 | Interspeech | Multistream Bandpass Modulation Features for Robust Speech Recognition. | Sridhar Krishna Nemala, Kailash Patil, Mounya Elhilali |
| 2010 | ICASSP | A joint acoustic and phonological approach to speech intelligibility assessment. | Sridhar Krishna Nemala, Mounya Elhilali |
| 2010 | ICASSP | Sparse coding for speech recognition. | Garimella S. V. S. Sivaram, Sridhar Krishna Nemala, Mounya Elhilali, Trac D. Tran, Hynek Hermansky |
| 2009 | Interspeech | Discriminant spectrotemporal features for phoneme recognition. | Nima Mesgarani, Garimella S. V. S. Sivaram, Sridhar Krishna Nemala, Mounya Elhilali, Hynek Hermansky |
| 2008 | ICASSP | Information-bearing components of speech intelligibility under babble-noise and bandlimiting distortions. | Mounya Elhilali, Shihab A. Shamma |
| 2006 | ICASSP | A Biologically-Inspired Approach to the Cocktail Party Problem. | Mounya Elhilali, Shihab A. Shamma |