| 2025 | Acoustic and Linguistic Biomarkers for Cognitive Impairment Detection from Speech. | Catarina Botelho, David Gimeno-Gmez, Francisco Teixeira, John Mendona, Patrcia Pereira, Diogo A. P. Nunes, Thomas Rolland, Anna Pompili, Rubn Solera-Urea, Maria Ponte, David Martins de Matos, Carlos D. Martnez-Hinarejos, Isabel Trancoso, Alberto Abad |
| 2025 | Benchmarking Time-localized Explanations for Audio Classification Models. | Cecilia Bolaos, Leonardo Pepino, Martn Meza, Luciana Ferrer |
| 2025 | Speech Reduction in French: The Relationship Between Vowel Space and Articulation Dynamics. | Kbra Bodur, Corinne Fredouille, Christine Meunier |
| 2025 | Fact-Controlled Diagnosis of Hallucinations in Medical Text Summarization. | Suhas BN, Han-Chin Shing, Lei Xu, Mitch Strong, Jon Burnsky, Jessica Ofor, Jordan R. Mason, Susan Chen, Sundararajan Srinivasan, Chaitanya Shivade, Jack Moriarty, Joseph Paul Cohen |
| 2025 | Structured Codebook Based Hierarchical Framework for DNN for Computationally Efficient Speech Enhancement. | Chidambar B, Hanumanth Rao Naidu |
| 2025 | A Multi-Dialectal Dataset for German Dialect ASR and Dialect-to-Standard Speech Translation. | Verena Blaschke, Miriam Winkler, Constantin Frster, Gabriele Wenger-Glemser, Barbara Plank |
| 2025 | REWIND: Speech Time Reversal for Enhancing Speaker Representations in Diffusion-based Voice Conversion. | Ishan D. Biyani, Nirmesh J. Shah, Ashishkumar P. Gudmalwar, Pankaj Wasnik, Rajiv Ratn Shah |
| 2025 | Adapting Whisper for low-resource Hindi-English Code-Mix speech with on-the-fly Augmentation & LLM-Synthesised Data. | Astik Biswas, Oleg Shevelev, Amine Abdaoui, Vivek Tyagi, Abdelmoumene Boumadane |
| 2025 | QUADS: Quantized Distillation Framework for Efficient Speech Language Understanding. | Subrata Biswas, Mohammad Nur Hossain Khan, Bashima Islam |
| 2025 | Evaluation of a model for sound radiation from the vocal tract wall. | Peter Birkholz, Tianyi Zhang |
| 2025 | Influence of wall coverings of 3D-printed vocal tract models on measured transfer functions. | Peter Birkholz, Dominik Schfer, Patrick Hsner, Jihyeon Yun, Iris Kruppke, Rmi Blandin |
| 2025 | Multi-Teacher Language-Aware Knowledge Distillation for Multilingual Speech Emotion Recognition. | Mehedi Hasan Bijoy, Dejan Porjazovski, Tams Grsz, Mikko Kurimo |
| 2025 | From Context to Code-switching: Examining the Interplay of Language Proficiency and Multilingualism in Speech. | Debasmita Bhattacharya, Aanya Tolat, Julia Hirschberg |
| 2025 | Benchmarking and Confidence Evaluation of LALMs For Temporal Reasoning. | Debarpan Bhattacharya, Apoorva Kulkarni, Sriram Ganapathy |
| 2025 | Articulatory modeling of the S-shaped F2 trajectories observed in hman's spectrographic analysis of VCV syllables. | Frdric Berthommier |
| 2025 | Non-Standard Accent TTS Support via Large Multi-Accent Frontend Pronunciation Knowledge Transfer. | Noe Berger, Siqi Sun, Korin Richmond |
| 2025 | Subtyping Speech Errors in Childhood Speech Sound Disorders with Acoustic-to-Articulatory Speech Inversion. | Nina R. Benway, Saba Tabatabaee, Benjamin Munson, Jonathan Preston, Carol Y. Espy-Wilson |
| 2025 | Word stress in self-supervised speech models: A cross-linguistic comparison. | Martijn Bentum, Louis ten Bosch, Tomas O. Lentz |
| 2025 | Introducing EMOPARKNZ: the Emotional Speech Database from New Zealand English Speakers with Parkinson's Disease. | Itay Ben-Dom, Catherine I. Watson, Clare M. McCann |
| 2025 | SPEAKtoCOPD: a flashmob study to collect COPD speech. | Loes van Bemmel, Lauren G. Reinders, Folkert Brijker, Bas Holverda, Frits M. E. Franssen, Hanneke van Helvoort, Visara Urovi, Marieke Spreeuwenberg, Sami O. Simons |
| 2025 | Test-Time Training for Speech Enhancement. | Avishkar Behera, Riya Ann Easow, Venkatesh Parvathala, K. Sri Rama Murty |
| 2025 | Pathology-Aware Speech Encoding and Data Augmentation for Dysarthric Speech Recognition. | Ilja Baumann, Dominik Wagner, Korbinian Riedhammer, Tobias Bocklet |
| 2025 | Heart Rate as a Proxy Measure to Assess Human Confidence in Spoken Speech. | Harish Battula, Gauri Deshpande, Yagna Gudipalli, Sachin Patel |
| 2025 | Stress in Spoken and Whistled Greek. | Andre Batchelder-Schwab, Vasileios Michos, Jonathan Barnes |
| 2025 | NGPU-LM: GPU-Accelerated N-Gram Language Model for Context-Biasing in Greedy ASR Decoding. | Vladimir Bataev, Andrei Andrusenko, Lilit Grigoryan, Aleksandr Laptev, Vitaly Lavrukhin, Boris Ginsburg |