Mirco Ravanelli
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
51
Venues
9
Active years
2013–2025
Best venue rank
A*
Where they publish
Papers
51 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ICASSP | What Are They Doing? Joint Audio-Speech Co-Reasoning. | Yingzhi Wang, Pooneh Mousavi, Artem Ploujnikov, Mirco Ravanelli |
| 2025 | ICASSP | LMAC-TD: Producing Time Domain Explanations for Audio Classifiers. | Eleonora Mancini, Francesco Paissan, Mirco Ravanelli, Cem Subakan |
| 2025 | ICASSP | Investigating the Effectiveness of Explainability Methods in Parkinson's Detection from Speech. | Eleonora Mancini, Francesco Paissan, Paolo Torroni, Mirco Ravanelli, Cem Subakan |
| 2025 | Interspeech | LiSTEN: Learning Soft Token Embeddings for Neural Audio LLMs. | Pooneh Mousavi, Shubham Gupta, Cem Subakan, Mirco Ravanelli |
| 2025 | Interspeech | Calm-Whisper: Reduce Whisper Hallucination On Non-Speech By Calming Crazy Heads Down. | Yingzhi Wang, Anas Alhmoud, Saad Alsahly, Muhammad Alqurishi, Mirco Ravanelli |
| 2024 | COLING | TARIC-SLU: A Tunisian Benchmark Dataset for Spoken Language Understanding. | Salima Mdhaffar, Fethi Bougares, Renato de Mori, Salah Zaiem, Mirco Ravanelli, Yannick Estve |
| 2024 | EMNLP | Adaptation Odyssey in LLMs: Why Does Additional Pretraining Sometimes Fail to Improve? | Firat ncel, Matthias Bethge, Beyza Ermis, Mirco Ravanelli, Cem Subakan, agatay Yildiz |
| 2024 | ICASSP | Focal Modulation Networks for Interpretable Sound Classification. | Luca Della Libera, Cem Subakan, Mirco Ravanelli |
| 2024 | ICASSP | Resource-Efficient Separation Transformer. | Luca Della Libera, Cem Subakan, Mirco Ravanelli, Samuele Cornell, Frdric Lepoutre, Franois Grondin |
| 2024 | ICASSP | Skill: Similarity-Aware Knowledge Distillation for Speech Self-Supervised Learning. | Luca Zampierin, Ghouthi Boukli Hacene, Bac Nguyen, Mirco Ravanelli |
| 2024 | ICLR | Towards Foundational Models for Molecular Learning on Large-Scale Multi-Task Datasets. | Dominique Beaini, Shenyang Huang, Joao Alex Cunha, Zhiyi Li, Gabriela Moisescu-Pareja, Oleksandr Dymov, Samuel Maddrell-Mander, Callum McLean, Frederik Wenkel, Luis Mller, Jama Hussein Mohamud, Ali Parviz, Michael Craig, Michal Koziarski, Jiarui Lu, Zhaocheng Zhu, Cristian Gabellini, Kerstin Klaser, Josef Dean, Cas Wognum, Maciej Sypetkowski, Guillaume Rabusseau, Reihaneh Rabbany, Jian Tang, Christopher Morris, Mirco Ravanelli, Guy Wolf, Prudencio Tossou, Hadrien Mary, Therence Bois, Andrew W. Fitzgibbon, Blazej Banaszewski, Chad Martin, Dominic Masters |
| 2024 | ICML | Listenable Maps for Audio Classifiers. | Francesco Paissan, Mirco Ravanelli, Cem Subakan |
| 2024 | Interspeech | Phoneme Discretized Saliency Maps for Explainable Detection of AI-Generated Voice. | Shubham Gupta, Mirco Ravanelli, Pascal Germain, Cem Subakan |
| 2024 | Interspeech | How Should We Extract Discrete Audio Tokens from Self-Supervised Models? | Pooneh Mousavi, Jarod Duret, Salah Zaiem, Luca Della Libera, Artem Ploujnikov, Cem Subakan, Mirco Ravanelli |
| 2024 | Interspeech | Audio Editing with Non-Rigid Text Prompts. | Francesco Paissan, Luca Della Libera, Zhepei Wang, Paris Smaragdis, Mirco Ravanelli, Cem Subakan |
| 2023 | ASRU | TorchAudio 2.1: Advancing Speech Recognition, Self-Supervised Learning, and Audio Processing Components for Pytorch. | Jeff Hwang, Moto Hira, Caroline Chen, Xiaohui Zhang, Zhaoheng Ni, Guangzhi Sun, Pingchuan Ma, Ruizhe Huang, Vineel Pratap, Yuekai Zhang, Anurag Kumar, Chin-Yun Yu, Chuang Zhu, Chunxi Liu, Jacob Kahn, Mirco Ravanelli, Peng Sun, Shinji Watanabe, Yangyang Shi, Yumeng Tao |
| 2023 | ASRU | Rescuespeech: A German Corpus for Speech Recognition in Search and Rescue Domain. | Sangeet Sagar, Mirco Ravanelli, Bernd Kiefer, Ivana Kruijff-Korbayov, Josef van Genabith |
| 2023 | ASRU | Speech Emotion Diarization: Which Emotion Appears When? | Yingzhi Wang, Mirco Ravanelli, Alya Yacoubi |
| 2023 | CVPR | Simulated Annealing in Early Layers Leads to Better Generalization. | AmirMohammad Sarfi, Zahra Karimpour, Muawiz Chaudhary, Nasir Mohammad Khalid, Mirco Ravanelli, Sudhir P. Mudur, Eugene Belilovsky |
| 2023 | ICASSP | Fine-Tuning Strategies for Faster Inference Using Speech Self-Supervised Models: A Comparative Study. | Salah Zaiem, Robin Algayres, Titouan Parcollet, Slim Essid, Mirco Ravanelli |
| 2023 | Interspeech | Speech Self-Supervised Representation Benchmarking: Are We Doing it Right? | Salah Zaiem, Youcef Kemiche, Titouan Parcollet, Slim Essid, Mirco Ravanelli |
| 2022 | ICASSP | MetricGAN-U: Unsupervised Speech Enhancement/ Dereverberation Based Only on Noisy/ Reverberated Speech. | Szu-Wei Fu, Cheng Yu, Kuo-Hsuan Hung, Mirco Ravanelli, Yu Tsao |
| 2022 | ICASSP | Real-M: Towards Speech Separation on Real Mixtures. | Cem Subakan, Mirco Ravanelli, Samuele Cornell, Franois Grondin |
| 2022 | Interspeech | SoundChoice: Grapheme-to-Phoneme Models with Semantic Disambiguation. | Artem Ploujnikov, Mirco Ravanelli |
| 2022 | Interspeech | OSSEM: one-shot speaker adaptive speech enhancement using meta learning. | Cheng Yu, Szu-Wei Fu, Tsun-An Hsieh, Yu Tsao, Mirco Ravanelli |
| 2021 | ICASSP | Attention Is All You Need In Speech Separation. | Cem Subakan, Mirco Ravanelli, Samuele Cornell, Mirko Bronzi, Jianyuan Zhong |
| 2021 | Interspeech | ECAPA-TDNN Embeddings for Speaker Diarization. | Nauman Dawalatabad, Mirco Ravanelli, Franois Grondin, Jenthe Thienpondt, Brecht Desplanques, Hwidong Na |
| 2021 | Interspeech | MetricGAN+: An Improved Version of MetricGAN for Speech Enhancement. | Szu-Wei Fu, Cheng Yu, Tsun-An Hsieh, Peter Plantinga, Mirco Ravanelli, Xugang Lu, Yu Tsao |
| 2021 | Interspeech | The Energy and Carbon Footprint of Training End-to-End Speech Recognizers. | Titouan Parcollet, Mirco Ravanelli |
| 2020 | ICASSP | Using Speech Synthesis to Train End-To-End Spoken Language Understanding Models. | Loren Lugosch, Brett H. Meyer, Derek Nowrouzezahrai, Mirco Ravanelli |
| 2020 | ICASSP | Multi-Task Self-Supervised Learning for Robust Speech Recognition. | Mirco Ravanelli, Jianyuan Zhong, Santiago Pascual, Pawel Swietojanski, Joo Monteiro, Jan Trmal, Yoshua Bengio |
| 2020 | Interspeech | Quaternion Neural Networks for Multi-Channel Distant Speech Recognition. | Xinchi Qiu, Titouan Parcollet, Mirco Ravanelli, Nicholas D. Lane, Mohamed Morchid |
| 2019 | ICASSP | The Pytorch-kaldi Speech Recognition Toolkit. | Mirco Ravanelli, Titouan Parcollet, Yoshua Bengio |
| 2019 | ICLR | Quaternion Recurrent Neural Networks. | Titouan Parcollet, Mirco Ravanelli, Mohamed Morchid, Georges Linars, Chiheb Trabelsi, Renato De Mori, Yoshua Bengio |
| 2019 | Interspeech | Speech Model Pre-Training for End-to-End Spoken Language Understanding. | Loren Lugosch, Mirco Ravanelli, Patrick Ignoto, Vikrant Singh Tomar, Yoshua Bengio |
| 2019 | Interspeech | Learning Problem-Agnostic Speech Representations from Multiple Self-Supervised Tasks. | Santiago Pascual, Mirco Ravanelli, Joan Serr, Antonio Bonafonte, Yoshua Bengio |
| 2019 | Interspeech | Learning Speaker Representations with Mutual Information. | Mirco Ravanelli, Yoshua Bengio |
| 2018 | Interspeech | Twin Regularization for Online Speech Recognition. | Mirco Ravanelli, Dmitriy Serdyuk, Yoshua Bengio |
| 2017 | ICASSP | A network of deep neural networks for Distant Speech Recognition. | Mirco Ravanelli, Philemon Brakel, Maurizio Omologo, Yoshua Bengio |
| 2017 | Interspeech | Improving Speech Recognition by Revising Gated Recurrent Units. | Mirco Ravanelli, Philemon Brakel, Maurizio Omologo, Yoshua Bengio |
| 2016 | Interspeech | Realistic Multi-Microphone Data Simulation for Distant Speech Recognition. | Mirco Ravanelli, Piergiorgio Svaizer, Maurizio Omologo |
| 2016 | Interspeech | Discussion. | Dayana Ribas, Emmanuel Vincent, John H. L. Hansen, Emma Jokinen, Mirco Ravanelli, Hannes Gamper, Fred Richardson |
| 2015 | ASRU | The DIRHA-ENGLISH corpus and related tasks for distant-speech recognition in domestic environments. | Mirco Ravanelli, Luca Cristoforetti, Roberto Gretter, Marco Pellin, Alessandro Sosi, Maurizio Omologo |
| 2015 | ICASSP | A multi-channel corpus for distant-speech interaction in presence of known interferences. | Erich Zwyssig, Mirco Ravanelli, Piergiorgio Svaizer, Maurizio Omologo |
| 2015 | Interspeech | Contaminated speech training methods for robust DNN-HMM distant speech recognition. | Mirco Ravanelli, Maurizio Omologo |
| 2014 | Interspeech | Audio-concept features and hidden Markov models for multimedia event detection. | Benjamin Elizalde, Mirco Ravanelli, Karl Ni, Damian Borth, Gerald Friedland |
| 2014 | Interspeech | The DIRHA-GRID corpus: baseline and tools for multi-room distant speech recognition using distributed microphones. | Marco Matassoni, Ramn Fernandez Astudillo, Athanasios Katsamanis, Mirco Ravanelli |
| 2014 | Interspeech | On the selection of the impulse responses for distant-speech recognition based on contaminated speech training. | Mirco Ravanelli, Maurizio Omologo |
| 2014 | LREC | The DIRHA simulated corpus. | Luca Cristoforetti, Mirco Ravanelli, Maurizio Omologo, Alessandro Sosi, Alberto Abad, Martin Hagmueller, Petros Maragos |
| 2013 | Interspeech | Audio Concept Ranking for Video Event Detection on User-Generated Content. | Benjamin Elizalde, Mirco Ravanelli, Gerald Friedland |
| 2013 | Interspeech | Embedding speech recognition to control lights. | Alessandro Sosi, Fabio Brugnara, Luca Cristoforetti, Marco Matassoni, Mirco Ravanelli, Maurizio Omologo |