| 2025 | ICASSP | Joint Semantic Knowledge Distillation and Masked Acoustic Modeling for Full-band Speech Restoration With Improved Intelligibility. | Xiaoyu Liu, Xu Li, Joan Serr, Santiago Pascual |
| 2025 | ICASSP | Sequential Contrastive Audio-Visual Learning. | Ioannis Tsiamas, Santiago Pascual, Chunghsin Yeh, Joan Serr |
| 2024 | AAAI | V2A-Mapper: A Lightweight Solution for Vision-to-Audio Generation by Connecting Foundation Models. | Heng Wang, Jianbo Ma, Santiago Pascual, Richard Cartwright, Weidong Cai |
| 2024 | ECCV | Masked Generative Video-to-Audio Transformers with Enhanced Synchronicity. | Santiago Pascual, Chunghsin Yeh, Ioannis Tsiamas, Joan Serr |
| 2024 | ICASSP | GASS: Generalizing Audio Source Separation with Large-Scale Data. | Jordi Pons, Xiaoyu Liu, Santiago Pascual, Joan Serr |
| 2023 | ICASSP | Full-Band General Audio Synthesis with Score-Based Diffusion. | Santiago Pascual, Gautam Bhattacharya, Chunghsin Yeh, Jordi Pons, Joan Serr |
| 2023 | ICASSP | Adversarial Permutation Invariant Training for Universal Sound Separation. | Emilian Postolache, Jordi Pons, Santiago Pascual, Joan Serr |
| 2022 | ICASSP | On Loss Functions and Evaluation Metrics for Music Source Separation. | Enric Gus, Jordi Pons, Santiago Pascual, Joan Serr |
| 2021 | ICASSP | Upsampling Artifacts in Neural Audio Synthesis. | Jordi Pons, Santiago Pascual, Giulio Cengarle, Joan Serr |
| 2021 | ICASSP | SESQA: Semi-Supervised Learning for Speech Quality Assessment. | Joan Serr, Jordi Pons, Santiago Pascual |
| 2021 | ICASSP | Automatic Multitrack Mixing With A Differentiable Mixing Console Of Neural Audio Effects. | Christian J. Steinmetz, Jordi Pons, Santiago Pascual, Joan Serr |
| 2020 | ICASSP | Multi-Task Self-Supervised Learning for Robust Speech Recognition. | Mirco Ravanelli, Jianyuan Zhong, Santiago Pascual, Pawel Swietojanski, Joo Monteiro, Jan Trmal, Yoshua Bengio |
| 2020 | Interspeech | CATOTRON - A Neural Text-to-Speech System in Catalan. | Baybars Klebi, Alp ktem, Alex Peir Lilja, Santiago Pascual, Mireia Farrs |
| 2019 | CVPR | WAV2PIX: Speech-conditioned Face Generation using Generative Adversarial Networks. | Amanda Cardoso Duarte, Francisco Roldan, Miquel Tubau, Janna Escur, Santiago Pascual, Amaia Salvador, Eva Mohedano, Kevin McGuinness, Jordi Torres, Xavier Gir-i-Nieto |
| 2019 | ICASSP | Wav2Pix: Speech-conditioned Face Generation Using Generative Adversarial Networks. | Amanda Cardoso Duarte, Francisco Roldan, Miquel Tubau, Janna Escur, Santiago Pascual, Amaia Salvador, Eva Mohedano, Kevin McGuinness, Jordi Torres, Xavier Gir-i-Nieto |
| 2019 | Interspeech | Learning Problem-Agnostic Speech Representations from Multiple Self-Supervised Tasks. | Santiago Pascual, Mirco Ravanelli, Joan Serr, Antonio Bonafonte, Yoshua Bengio |
| 2019 | Interspeech | Towards Generalized Speech Enhancement with Generative Adversarial Networks. | Santiago Pascual, Joan Serr, Antonio Bonafonte |
| 2018 | ICASSP | Language and Noise Transfer in Speech Enhancement Generative Adversarial Network. | Santiago Pascual, Maruchan Park, Joan Serr, Antonio Bonafonte, Kang-Hun Ahn |
| 2018 | Interspeech | Spanish Statistical Parametric Speech Synthesis Using a Neural Vocoder. | Antonio Bonafonte, Santiago Pascual, Georgina Dorca |
| 2017 | Interspeech | SEGAN: Speech Enhancement Generative Adversarial Network. | Santiago Pascual, Antonio Bonafonte, Joan Serr |