| 2025 | ICASSP | Diffusion-based Unsupervised Audio-visual Speech Enhancement. | Jean-Eudes Ayilo, Mostafa Sadeghi, Romain Serizel, Xavier Alameda-Pineda |
| 2025 | ICASSP | Energy Consumption Trends in Sound Event Detection Systems. | Constance Douwes, Romain Serizel |
| 2025 | ICASSP | A decade of DCASE: Achievements, practices, evaluations and future challenges. | Annamaria Mesaros, Romain Serizel, Toni Heittola, Tuomas Virtanen, Mark D. Plumbley |
| 2025 | ICASSP | Latent Watermarking of Audio Generative Models. | Robin San Roman, Pierre Fernandez, Antoine Deleforge, Yossi Adi, Romain Serizel |
| 2025 | MMSP | Towards Low-Latency Tracking of Multiple Speakers With Short-Context Speaker Embeddings. | Taous Iatariene, Alexandre Gurin, Romain Serizel |
| 2025 | MMSP | Frequency-Weighted Training Losses for Phoneme-Level DNN-based Speech Enhancement. | Nasser-Eddine Monir, Paul Magron, Romain Serizel |
| 2024 | COLING | RoboVox: A Single/Multi-channel Far-field Speaker Recognition Benchmark for a Mobile Robot. | Mohammad MohammadAmini, Driss Matrouf, Mickal Rouvier, Jean-Franois Bonastre, Romain Serizel, Thophile Gonos |
| 2024 | ICASSP | Diffusion-Based Speech Enhancement with a Weighted Generative-Supervised Learning Loss. | Jean-Eudes Ayilo, Mostafa Sadeghi, Romain Serizel |
| 2024 | ICASSP | A Weighted-Variance Variational Autoencoder Model for Speech Enhancement. | Ali Golmakani, Mostafa Sadeghi, Xavier Alameda-Pineda, Romain Serizel |
| 2024 | ICASSP | Self-Supervised Learning for Few-Shot Bird Sound Classification. | Ilyass Moummad, Nicolas Farrugia, Romain Serizel |
| 2024 | ICASSP | Unsupervised Speech Enhancement with Diffusion-Based Generative Models. | Bern Nortier, Mostafa Sadeghi, Romain Serizel |
| 2024 | ICASSP | Performance and Energy Balance: A Comprehensive Study of State-of-the-Art Sound Event Detection Systems. | Francesca Ronchini, Romain Serizel |
| 2024 | ICASSP | Posterior Sampling Algorithms for Unsupervised Speech Enhancement with Recurrent Variational Autoencoder. | Mostafa Sadeghi, Romain Serizel |
| 2024 | Interspeech | Multi-Channel Extension of Pre-trained Models for Speaker Verification. | Ladislav Mosner, Romain Serizel, Luks Burget, Oldrich Plchot, Emmanuel Vincent, Junyi Peng, Jan Cernock |
| 2023 | ICASSP | Lightweight Annotation and Class Weight Training for Automatic Estimation of Alarm Audibility in Noise. | Franois Effa, Romain Serizel, Jean-Pierre Arz, Nicolas Grimault |
| 2023 | ICASSP | Audio-Visual Speech Enhancement with a Deep Kalman Filter Generative Model. | Ali Golmakani, Mostafa Sadeghi, Romain Serizel |
| 2023 | ICASSP | Spice+: Evaluation of Automatic Audio Captioning Systems with Pre-Trained Language Models. | Flix Gontier, Romain Serizel, Christophe Cerisara |
| 2023 | ICASSP | Fast and Efficient Speech Enhancement with Variational Autoencoders. | Mostafa Sadeghi, Romain Serizel |
| 2023 | ICASSP | Performance Above All? Energy Consumption vs. Performance, a Study on Sound Event Detection with Heterogeneous Data. | Romain Serizel, Samuele Cornell, Nicolas Turpault |
| 2023 | Interspeech | Self-supervised learning with Diffusion-based multichannel speech enhancement for speaker verification under noisy conditions. | Sandipana Dowerah, Ajinkya Kulkarni, Romain Serizel, Denis Jouvet |
| 2022 | ICASSP | Threshold Independent Evaluation of Sound Event Detection Scores. | Janek Ebbers, Reinhold Haeb-Umbach, Romain Serizel |
| 2022 | ICASSP | A Benchmark of State-of-the-Art Sound Event Detection Systems Evaluated on Synthetic Soundscapes. | Francesca Ronchini, Romain Serizel |
| 2022 | Interspeech | Barlow Twins self-supervised learning for robust speaker recognition. | Mohammad MohammadAmini, Driss Matrouf, Jean-Franois Bonastre, Sandipana Dowerah, Romain Serizel, Denis Jouvet |
| 2021 | ICASSP | Improving Sound Event Detection Metrics: Insights from DCASE 2020. | Giacomo Ferroni, Nicolas Turpault, Juan Azcarreta, Francesco Tuveri, Romain Serizel, agdas Bilen, Sacha Krstulovic |
| 2021 | ICASSP | Distributed Speech Separation in Spatially Unconstrained Microphone Arrays. | Nicolas Furnon, Romain Serizel, Irina Illina, Slim Essid |
| 2021 | ICASSP | Sound Event Detection and Separation: A Benchmark on Desed Synthetic Soundscapes. | Nicolas Turpault, Romain Serizel, Scott Wisdom, Hakan Erdogan, John R. Hershey, Eduardo Fonseca, Prem Seetharaman, Justin Salamon |
| 2021 | ICASSP | What's all the Fuss about Free Universal Sound Separation Data? | Scott Wisdom, Hakan Erdogan, Daniel P. W. Ellis, Romain Serizel, Nicolas Turpault, Eduardo Fonseca, Justin Salamon, Prem Seetharaman, John R. Hershey |
| 2020 | ICASSP | DNN-based Distributed Multichannel Mask Estimation for Speech Enhancement in Microphone Arrays. | Nicolas Furnon, Romain Serizel, Irina Illina, Slim Essid |
| 2020 | ICASSP | Sound Event Detection in Synthetic Domestic Environments. | Romain Serizel, Nicolas Turpault, Ankit Parag Shah, Justin Salamon |
| 2020 | ICASSP | Limitations of Weak Labels for Embedding and Tagging. | Nicolas Turpault, Romain Serizel, Emmanuel Vincent |
| 2019 | ICASSP | Semi-supervised Triplet Loss Based Learning of Ambient Audio Embeddings. | Nicolas Turpault, Romain Serizel, Emmanuel Vincent |
| 2018 | ICASSP | Multiple-Input Neural Network-Based Residual Echo Suppression. | Guillaume Carbajal, Romain Serizel, Emmanuel Vincent, Eric Humbert |
| 2018 | ICASSP | Multichannel Speech Separation with Recurrent Neural Networks from High-Order Ambisonics Recordings. | Laurline Perotin, Romain Serizel, Emmanuel Vincent, Alexandre Gurin |
| 2017 | ICASSP | Supervised group nonnegative matrix factorisation with similarity constraints and applications to speaker identification. | Romain Serizel, Victor Bisot, Slim Essid, Gal Richard |
| 2016 | ICASSP | Acoustic scene classification with matrix factorization for unsupervised feature learning. | Victor Bisot, Romain Serizel, Slim Essid, Gal Richard |
| 2016 | ICASSP | Group nonnegative matrix factorisation with speaker and session variability compensation for speaker identification. | Romain Serizel, Slim Essid, Gal Richard |
| 2016 | ICIP | Machine listening techniques as a complement to video image analysis in forensics. | Romain Serizel, Victor Bisot, Slim Essid, Gal Richard |
| 2013 | ICASSP | Rank-1 approximation based multichannel wiener filtering algorithms for noise reduction in cochlear implants. | Romain Serizel, Marc Moonen, Bas van Dijk, Jan Wouters |