| 2025 | The Speech Accessibility Project: Best Practices for Collection and Curation of Disordered Speech. | Chris Zwilling, Mark Hasegawa-Johnson, Heather Hodges, Lorraine O. Ramig, Adina Bradshaw, Clarion Mendes, Heejin Kim, Alexandria Barkhimer, Laura Mattie, Meg Dickinson, Shawnise Carter, Marie Moore Channell |
| 2025 | Leveraging Ordinal Information for Speech-based Depression Classification. | Lishi Zuo, Man-Wai Mak |
| 2025 | The Sub-3Sec Problem: From Text-Independent to Text-Dependent Corpus. | Ruichen Zuo, Kong Aik Lee, Zilong Huang, Man-Wai Mak |
| 2025 | LATE: Open Source Toolkit for Latvian and Latgalian Speech Transcription. | Arturs Znotins, Didzis Gosko, Normunds Gruzitis |
| 2025 | A Robust Hybrid ACC-PM Approach for Personal Sound Zones. | Yaqi Zhu, Lei Zhou, Hongqing Liu, Liming Shi, Lu Gan |
| 2025 | SSF-DST: A Spectro-Spatial Features Enhanced Deep Spatiotemporal Network for EEG-Based Auditory Attention Detection. | Tong Zhu, Xiaoke Yang, Jian Zhou, Lu Li, Zhao Lv, Cunhang Fan |
| 2025 | LLM-Synth4KWS: Scalable Automatic Generation and Synthesis of Confusable Data for Custom Keyword Spotting. | Pai Zhu, Quan Wang, Dhruuv Agarwal, Kurt Partridge |
| 2025 | VietASR: Achieving Industry-level Vietnamese ASR with 50-hour labeled data and Large-Scale Speech Pretraining. | Jianheng Zhuo, Yifan Yang, Yiwen Shao, Yong Xu, Dong Yu, Kai Yu, Xie Chen |
| 2025 | Towards Efficiently Whisper Fine-tuning with Monotonic Alignments. | Ziyang Zhuang, Tao Wei, Ming Fang, Ning Cheng, Shaojun Wang, Jing Xiao |
| 2025 | Emotion-Guided Graph Attention Networks for Speech-Based Depression Detection under Emotion-Inducting Tasks. | Yuqiu Zhou, Yongjie Zhou, Yudong Yang, Yang Liu, Jun Huang, Shuzhi Zhao, Rongfeng Su, Lan Wang, Nan Yan |
| 2025 | Adapting Whisper for Streaming Speech Recognition via Two-Pass Decoding. | Haoran Zhou, Xingchen Song, Brendan Fahy, Qiaochu Song, Binbin Zhang, Zhendong Peng, Anshul Wadhawan, Denglin Jiang, Apurv Verma, Vinay Ramesh, Srivas Prasad, Michele M. Franceschini |
| 2025 | No Audiogram: Leveraging Existing Scores for Personalized Speech Intelligibility Prediction. | Haoshuai Zhou, Changgeng Mo, Boxuan Cao, Linkai Li, Shan Xiang Wang |
| 2025 | Infant Cry Emotion Recognition Using Improved ECAPA-TDNN with Multi-scale Feature Fusion and Attention Enhancement. | Junyu Zhou, Yanxiong Li, Haolin Yu |
| 2025 | Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling. | Xuanru Zhou, Jiachen Lian, Cheol Jun Cho, Tejas S. Prabhune, Shuhe Li, William Li, Rodrigo Ortiz, Zoe Ezzes, Jet Vonk, Brittany Morin, Rian Bogley, Lisa Wauters, Zachary A. Miller, Maria Luisa Gorno-Tempini, Gopala Anumanchipalli |
| 2025 | Cross-corpus open-set Speech Emotion Recognition Method Based on Spatiotemporal Features with Inverse-Entropy Regularization. | Zhaohui Zhou, Hui Luo |
| 2025 | Acoustic Detection of UAV Abnormality Using One Ground-Based Acoustic Vector Sensor. | Dengjian Zhou, Jianghan Hai, Sijia Liao, Yue Ivan Wu, Kainam Thomas Wong, Xiujuan Zheng |
| 2025 | Evaluation of Three Automatic Alignment Tools for the Processing of Non-native French. | Qian Zhou, Mathilde Hutin |
| 2025 | Simple and Effective Content Encoder for Singing Voice Conversion via SSL-Embedding Dimension Reduction. | Wangjin Zhou, Tianjiao Du, Chenglin Xu, Sheng Li, Yi Zhao, Tatsuya Kawahara |
| 2025 | A Simple-Yet-Effective Data Augmentation Method for Speaker Identification in Novels. | Wenjie Zhong, Jason Naradowsky, Yusuke Miyao |
| 2025 | Pairwise Evaluation of Accent Similarity in Speech Synthesis. | Jinzuomu Zhong, Suyuan Liu, Dan Wells, Korin Richmond |
| 2025 | Evaluating the Usefulness of Non-Diagnostic Speech Data for Developing Parkinson's Disease Classifiers. | Terry Yi Zhong, Esther Janse, Cristian Tejedor Garca, Louis ten Bosch, Martha A. Larson |
| 2025 | Regularized Federated Learning for Privacy-Preserving Dysarthric and Elderly Speech Recognition. | Tao Zhong, Mengzhe Geng, Shujie Hu, Guinan Li, Xunying Liu |
| 2025 | FreeCodec: A Disentangled Neural Speech Codec with Fewer Tokens. | Youqiang Zheng, Weiping Tu, Yueteng Kang, Jie Chen, Yike Zhang, Li Xiao, Yuhong Yang, Long Ma |
| 2025 | Pinyin-Guided Chinese Speech Recognition with Large Language Model. | Jie Zhengjie, Gaofeng Cheng |
| 2025 | Accelerating Flow-Matching-Based Text-to-Speech via Empirically Pruned Step Sampling. | Qixi Zheng, Yushen Chen, Zhikang Niu, Ziyang Ma, Xiaofei Wang, Kai Yu, Xie Chen |