| 2025 | FLASepformer: Efficient Speech Separation with Gated Focused Linear Attention Transformer. | Haoxu Wang, Yiheng Jiang, Gang Qiao, Pengteng Shi, Biao Tian |
| 2025 | On Apical Vowels in Eastern Zhenjiang Mandarin. | Xuying Wang, Fang Hu |
| 2025 | Discl-VC: Disentangled Discrete Tokens and In-Context Learning for Controllable Zero-Shot Voice Conversion. | Kaidi Wang, Wenhao Guan, Ziyue Jiang, Hukai Huang, Peijie Chen, Weijie Wu, Qingyang Hong, Lin Li |
| 2025 | Semantic Processing During Spoken Word Production by Children with Cochlear Implants. | Man Wang, Yixin Ding, Niels O. Schiller |
| 2025 | Enhancing Speech Emotion Recognition with Multi-Task Learning and Dynamic Feature Fusion. | Honghong Wang, Jing Deng, Fanqin Meng, Rong Zheng |
| 2025 | Self-Improvement for Audio Large Language Model using Unlabeled Speech. | Shaowen Wang, Xinyuan Chen, Yao Xu |
| 2025 | SpeechDialogueFactory: A Framework for Natural Speech Dialogue Generation. | Minghan Wang, Ye Bai, Yuxia Wang, Thuy-Trang Vu, Ehsan Shareghi, Gholamreza Haffari |
| 2025 | Calm-Whisper: Reduce Whisper Hallucination On Non-Speech By Calming Crazy Heads Down. | Yingzhi Wang, Anas Alhmoud, Saad Alsahly, Muhammad Alqurishi, Mirco Ravanelli |
| 2025 | Open Universal Arabic ASR Leaderboard. | Yingzhi Wang, Anas Alhmoud, Muhammad Alqurishi |
| 2025 | Adaptive Across-Subcenter Representation Learning for Imbalanced Anomalous Sound Detection. | Dong Wang, Jiqing Han, Guibin Zheng, Tieran Zheng, Yongjun He |
| 2025 | Dual Orthogonality Sub-center Loss for Enhanced Anomalous Sound Detection. | Dong Wang, Jiqing Han, Tieran Zheng, Guibin Zheng, Yongjun He |
| 2025 | Prosodic Structure Beyond Lexical Content: A Study of Self-Supervised Learning. | Sarenne Wallbridge, Christoph Minixhofer, Catherine Lai, Peter Bell |
| 2025 | Real-time TSE demonstration via SoundBeam with KD. | Keigo Wakayama, Tomoko Kawase, Takafumi Moriya, Marc Delcroix, Hiroshi Sato, Tsubasa Ochiai, Masahiro Yasuda, Shoko Araki |
| 2025 | From Speech Science to Language Transparence. | Alexander Waibel |
| 2025 | The Role of Voiced Consonant Duration in Sung Vowel-Consonant and Consonant-Vowel Recognition. | Allan Vurma, Einar Meister, Lya Meister, Jaan Ross, Marju Raju, Veeda Kala, Tuuri Dede |
| 2025 | LiRI Corpus Platform: Demonstration of a Web-Based Infrastructure for Multimodal Corpus Analysis. | Teodora Vukovic, Jrmy Zehr, Jonathan Schaber, Igor Mustac, Nikolina Rajovic, Daniel McDonald, Johannes Gran, Noah Bubenhofer |
| 2025 | Multimodal Prosody Modeling: A Use Case for Multilingual Sentence Mode Prediction. | Bogdan Vlasenko, Mathew Magimai-Doss |
| 2025 | Spoken Language Modeling with Duration-Penalized Self-Supervised Units. | Nicol Visser, Herman Kamper |
| 2025 | Comparison of Acoustic and Textual Features for Dysarthria Severity Classification in Amyotrophic Lateral Sclerosis. | Y. S. Upendra Vishwanath, Tanuka Bhattacharjee, Deekshitha G, Sathvik Udupa, Chowdam Venkata Thirumala Kumar, Madassu Keerthipriya, Darshan Chikktimmegowda, Dipti Baskar, Yamini Belur, Seena Vengalil, Atchayaram Nalini, Prasanta Kumar Ghosh |
| 2025 | Analysis and Extension of a Near-End Listening Enhancement Method Based on Long-Term Fractile Noise Statistics. | Filippo Villani, Wai-Yip Chan, Zheng-Hua Tan, Jan stergaard, Jesper Jensen |
| 2025 | Rollback Speech: Smart Feedback Prompts for Lost Utterances in Unstable Online Calls. | Yuni Amaloa Quintero Villalobos, Wafaa Wardah, Sebastian Mller, Robert P. Spang |
| 2025 | Regularizing Learnable Feature Extraction for Automatic Speech Recognition. | Peter Vieting, Maximilian Kannen, Benedikt Hilmes, Ralf Schlter, Hermann Ney |
| 2025 | Improving Automatic Speech Recognition for Children's Reading Assessment with Disfluency-aware Language Models. | Jazmn Vidal, Luciana Ferrer, Juan Esteban Kamienkowski, Pablo Riera |
| 2025 | Swedish Whispers; Leveraging a Massive Speech Corpus for Swedish Speech Recognition. | Leonora Vesterbacka, Faton Rekathati, Robin Kurtz, Justyna Sikora, Agnes Toftgrd |
| 2025 | How to Connect Speech Foundation Models and Large Language Models? What Matters and What Does Not. | Francesco Verdini, Pierfrancesco Melucci, Stefano Perna, Francesco Cariaggi, Marco Gaido, Sara Papi, Szymon Mazurek, Marek Kasztelnik, Luisa Bentivogli, Sbastien Bratires, Paolo Merialdo, Simone Scardapane |