| 2025 | Individualized speech enhancement for hearing-impaired listeners. | Chuan Wen, Sarah Verhulst |
| 2025 | A Dataset for Automatic Assessment of TTS Quality in Spanish. | Alejandro Sosa Welford, Leonardo Pepino |
| 2025 | ASVspoof2019 vs. ASVspoof5: Assessment and Comparison. | Avishai Weizman, Yehuda Ben-Shimol, Itshak Lapidot |
| 2025 | Investigating effects of sex hormones, cycle phases and age on female fundamental frequency. | Melanie Weirich, Adrian P. Simpson |
| 2025 | Disentangling Dual-Encoder Masked Autoencoder for Respiratory Sound Classification. | Peidong Wei, Shiyu Miao, Lin Li |
| 2025 | Transcribing Diverse Voices: Using Whisper for ICE corpora. | Andreas Weilinghoff |
| 2025 | Robustness of F0 Ratio as a Diagnostic: Comparing Creaky Voice in Danish and Seoul Korean. | Michaela Watkins, Rasmus Puggaard-Rode, Paul Boersma, Silke Hamann |
| 2025 | SQ-AST: A Transformer-Based Model for Speech Quality Prediction. | Wafaa Wardah, Robert P. Spang, Vincent Barriac, Jan Reimes, Anna Llagostera, Jens Berger, Sebastian Mller |
| 2025 | SpecTokenizer: A Lightweight Streaming Codec in the Compressed Spectrum Domain. | Zixiang Wan, Guochang Zhang, Yifeng He, Jianqiang Wei |
| 2025 | A Self-Training Approach for Whisper to Enhance Long Dysarthric Speech Recognition. | Shiyao Wang, Jiaming Zhou, Shiwan Zhao, Yong Qin |
| 2025 | Anomalous Sound Detection Based Feature Fusion and Dual-path Non-linear Independent Components Estimation. | Yawei Wang, Qiaoling Zhang, Yi Zhang, Junyao Hu |
| 2025 | Continual Speech Learning with Fused Speech Features. | Guitao Wang, Jinming Zhao, Hao Yang, Guilin Qi, Tongtong Wu, Gholamreza Haffari |
| 2025 | U-SAM: An Audio Language Model for Unified Speech, Audio, and Music Understanding. | Ziqian Wang, Xianjun Xia, Xinfa Zhu, Lei Xie |
| 2025 | VCapAV: A Video-Caption Based Audio-Visual Deepfake Detection Dataset. | Yuxi Wang, Yikang Wang, Qishan Zhang, Hiromitsu Nishizaki, Ming Li |
| 2025 | Decoding Alzheimer's: Interpretable Visual and Logical Attention in Picture Description Tasks. | Ning Wang, Bingyang Wen, Minghui Wu, Yang Sun, Zongru Shao, Haojie Zhou, K. P. Subbalakshmi |
| 2025 | Exploiting Echo Path Priors for Enhanced Stereo Acoustic Echo Cancellation. | Jinfu Wang, Ziteng Wang, Xin Liu, Yang Liu, Qing Shi, Zhengqiang Luo, Feiran Yang |
| 2025 | ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning. | Junyu Wang, Tianrui Wang, Meng Ge, Longbiao Wang, Jianwu Dang |
| 2025 | Contextual Paralinguistic Data Creation for Multi-Modal Speech-LLM: Data Condensation and Spoken QA Generation. | Qiongqiong Wang, Hardik B. Sailor, Tianchi Liu, Ai Ti Aw |
| 2025 | Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC. | Qingzheng Wang, Jiancheng Sun, Yifan Peng, Shinji Watanabe |
| 2025 | A Lightweight Hybrid Dual Channel Speech Enhancement System under Low-SNR Conditions. | Zheng Wang, Xiaobin Rong, Yu Sun, Tianchi Sun, Zhibin Lin, Jing Lu |
| 2025 | Speaker Targeting via Self-Speaker Adaptation for Multi-talker ASR. | Weiqing Wang, Taejin Park, Ivan Medennikov, Jinhan Wang, Kunal Dhawan, He Huang, Nithin Rao Koluguri, Jagadeesh Balam, Boris Ginsburg |
| 2025 | Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers. | Yuzhu Wang, Archontis Politis, Konstantinos Drossos, Tuomas Virtanen |
| 2025 | FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching. | Ziqian Wang, Zikai Liu, Xinfa Zhu, Yike Zhu, Mingshuai Liu, Jun Chen, Longshuai Xiao, Chao Weng, Lei Xie |
| 2025 | CAGCRN: Real-Time Speech Enhancement with a Lightweight Model for Joint Acoustic Echo Cancellation and Noise Suppression. | Yuyang Wang, Yonghui Liu, Jianbing Liu, Kai Niu, Zhiqiang He |
| 2025 | The role of audio-visual integration in the time course of phonetic encoding in self-supervised speech models. | Yi Wang, Oli Danyi Liu, Peter Bell |