| 2025 | ICASSP | SoloAudio: Target Sound Extraction with Language-oriented Audio Diffusion Transformer. | Helin Wang, Jiarui Hai, Yen-Ju Lu, Karan Thakkar, Mounya Elhilali, Najim Dehak |
| 2025 | ICASSP | SSR-Speech: Towards Stable, Safe and Robust Zero-shot Text-based Speech Editing and Synthesis. | Helin Wang, Meng Yu, Jiarui Hai, Chen Chen, Yuchen Hu, Rilin Chen, Najim Dehak, Dong Yu |
| 2025 | Interspeech | EzAudio: Enhancing Text-to-Audio Generation with Efficient Diffusion Transformer. | Jiarui Hai, Yong Xu, Hao Zhang, Chenxing Li, Helin Wang, Mounya Elhilali, Dong Yu |
| 2024 | ICASSP | DPM-TSE: A Diffusion Probabilistic Model for Target Sound Extraction. | Jiarui Hai, Helin Wang, Dongchao Yang, Karan Thakkar, Najim Dehak, Mounya Elhilali |
| 2024 | ICASSP | Investigating Self-Supervised Deep Representations for EEG-Based Auditory Attention Decoding. | Karan Thakkar, Jiarui Hai, Mounya Elhilali |
| 2024 | Interspeech | DreamVoice: Text-Guided Voice Conversion. | Jiarui Hai, Karan Thakkar, Helin Wang, Zengyi Qin, Mounya Elhilali |
| 2024 | Interspeech | Noise-robust Speech Separation with Fast Generative Correction. | Helin Wang, Jess Villalba, Laureano Moro-Velzquez, Jiarui Hai, Thomas Thebaud, Najim Dehak |
| 2023 | ASRU | Boosting Modality Representation With Pre-Trained Models and Multi-Task Training for Multimodal Sentiment Analysis. | Jiarui Hai, Yu-Jeh Liu, Mounya Elhilali |
| 2022 | AMIA | Leveraging Natural Language Processing and Time Series Models to Analyze COVID-19 Vaccination Sentiment Dynamics from Tweets. | Jiancheng Ye, Jiarui Hai, Zidan Wang, Chumei Wei |
| 2022 | ICASSP | Progressive Teacher-Student Training Framework for Music Tagging. | Rui Lu, Baigong Zheng, Jiarui Hai, Fei Tao, Zhiyao Duan, Ji Liu |