| 2025 | Creaky Voice Facilitates More Efficient Phonological Processing of Mandarin Tone 3. | Zixia Fan, Ronny Ibrahim, Joshua Penney, Felicity Cox |
| 2025 | MMLoRA: Multitask Memory Parameter-Efficient Fine-Tuning for Multimodal SER. | Yuanbo Fang, Xiaofen Xing, Xueru Li, Weibin Zhang, Xiangmin Xu |
| 2025 | Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning. | Shi-Xin Fang, Liang-Yeh Shen, Yi-Cheng Lin, Huang-Cheng Chou, Hung-yi Lee |
| 2025 | Multi-view Fusion and Parameter Perturbation for Few-Shot Class-Incremental Audio Classification. | Yulu Fang, Mingyue He, Qisheng Xu, Jianqiao Zhao, Cheng Yang, Kele Xu, Yong Dou |
| 2025 | Band-Split Self-supervised Mamba for Infant-centered Audio Analysis. | Xulin Fan, Jialu Li, Mark Hasegawa-Johnson, Nancy L. McElwain |
| 2025 | Audio Deepfake Source Tracing using Multi-Attribute Open-Set Identification and Verification. | Pierre Falez, Tony Marteau, Damien Lolive, Arnaud Delhay |
| 2025 | Speech Kinematic Analysis from Acoustics: Scientific, Clinical and Practical Applications. | Carol Y. Espy-Wilson |
| 2025 | Synchronous analysis of abnormal acoustic and linguistic production in Parkinson's speech. | Daniel Escobar-Grisales, Cristian David Ros-Urrego, Sabato Marco Siniscalchi, Adolfo M. Garca, Yamile Bocanegra, Leonardo Moreno, Elmar Nth, Juan Rafael Orozco-Arroyave |
| 2025 | From Words to Waves: Analyzing Concept Formation in Speech and Text-Based Foundation Models. | Asim Ersoy, Basel Ahmad Mousi, Shammur Absar Chowdhury, Firoj Alam, Fahim Dalvi, Nadir Durrani |
| 2025 | ProMode: A Speech Prosody Model Conditioned on Acoustic and Textual Inputs. | Eray Eren, Qingju Liu, Hyeongwoo Kim, Pablo Garrido, Abeer Alwan |
| 2025 | SiamCTC: Learning Speech Representations through Monotonic Temporal Alignment. | SooHwan Eom, Mark Hasegawa-Johnson, Chang D. Yoo |
| 2025 | The NaijaVoices Dataset: Cultivating Large-Scale, High-Quality, Culturally-Rich Speech Data for African Languages. | Chris Emezue, NaijaVoices Community, Busayo Awobade, Abraham Toluwase Owodunni, Handel Emezue, Gloria Monica Tobechukwu Emezue, Nefertiti Nneoma Emezue, Sewade Ogun, Bunmi Akinremi, David Ifeoluwa Adelani, Chris Pal |
| 2025 | Triadic Multi-party Voice Activity Projection for Turn-taking in Spoken Dialogue Systems. | Mikey Elmers, Koji Inoue, Divesh Lala, Tatsuya Kawahara |
| 2025 | ADI-20: Arabic Dialect Identification dataset and models. | Haroun Elleuch, Salima Mdhaffar, Yannick Estve, Fethi Bougares |
| 2025 | PERCEPT-US: A Multimodal American English Child Speech Corpus Specialized for Articulatory Feedback. | Amanda Eads, Heather Kabakoff, Nina Benway, Elaine Hitchcock, Jonathan L. Preston, Tara McAllister |
| 2025 | Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection? | Bikash Dutta, Rishabh Ranjan, Shyam Sathvik, Mayank Vatsa, Richa Singh |
| 2025 | ABHINAYA - A System for Speech Emotion Recognition In Naturalistic Conditions Challenge. | Soumya Dutta, Smruthi Balaji, Varada R, Viveka Salinamakki, Sriram Ganapathy |
| 2025 | SDBench: A Comprehensive Benchmark Suite for Speaker Diarization. | Berkin Durmus, Blaise Munyampirwa, Eduardo Pacheco, Atila Orhon, Andrey Leonov |
| 2025 | Functional Connectivity and Hilbert-Based Features for Covert Speech EEG Variability Analysis and Classification. | Saravanakumar Duraisamy, Maurice Rekrut, Luis A. Leiva |
| 2025 | Test-Time Training for Speech-based Depression Detection. | Sri Harsha Dumpala, Chandramouli Shama Sastry, Rudolf Uher, Sageev Oore |
| 2025 | EAA: Emotion-Aware Audio Large Language Models with Dual Cross-Attention and Context-Aware Instruction Tuning. | Hongfei Du, Sidi Lu, Gang Zhou, Ye Gao |
| 2025 | Tonal Contrasts in the Malipo Variety of the Mienic Language. | Changhong Du, Fang Hu |
| 2025 | Robust fine-tuning of speech recognition models via model merging: application to disordered speech. | Alexandre Ducorroy, Rachid Riad |
| 2025 | Hybrid Expert Knowledge and Self-Supervised Learning for Diagnostic Modeling of Adductor Spasmodic and Primary Myotonic Dysphonia. | Zhou Du, Hang Chen, Huijun Ding, Jun Du, Zhen Chen |
| 2025 | Speech transcription from South Tyrolean Dialect to Standard German with Whisper. | Luca Ducceschi, Greta H. Franzini |