| 2024 | Age-related Differences in Acoustic Cues for the Perception of Checked Syllables in Shengzhou Wu. | Bingliang Zhao, Jiangping Kong, Xiyu Wu |
| 2024 | Decoding Human Language Acquisition: EEG Evidence for Predictive Probabilistic Statistics in Word Segmentation. | Bin Zhao, Mingxuan Huang, Chenlu Ma, Jinyi Xue, Aijun Li, Kunyu Xu |
| 2024 | Sub-PNWR: Speech Enhancement Based on Signal Sub-Band Splitting and Pseudo Noisy Waveform Reconstruction Loss. | Yuewei Zhang, Huanbin Zou, Jie Zhu |
| 2024 | Neural Network Augmented Kalman Filter for Robust Acoustic Howling Suppression. | Yixuan Zhang, Hao Zhang, Meng Yu, Dong Yu |
| 2024 | Lightweight Dynamic Sparse Transformer for Monaural Speech Enhancement. | Zehua Zhang, Xuyi Zhuang, Yukun Qian, Mingjiang Wang |
| 2024 | TD-PLC: A Semantic-Aware Speech Encoding for Improved Packet Loss Concealment. | Jinghong Zhang, Zugang Zhao, Yonghui Liu, Jianbing Liu, Zhiqiang He, Kai Niu |
| 2024 | Disentangling Age and Identity with a Mutual Information Minimization for Cross-Age Speaker Verification. | Fengrun Zhang, Wangjin Zhou, Yiming Liu, Wang Geng, Yahui Shan, Chen Zhang |
| 2024 | DysArinVox: DYSphonia & DYSarthria mandARIN speech corpus. | Haojie Zhang, Tao Zhang, Ganjun Liu, Dehui Fu, Xiaohui Hou, Ying Lv |
| 2024 | An Exploration of Length Generalization in Transformer-Based Speech Enhancement. | Qiquan Zhang, Hongxu Zhu, Xinyuan Qian, Eliathamby Ambikairajah, Haizhou Li |
| 2024 | OR-TSE: An Overlap-Robust Speaker Encoder for Target Speech Extraction. | Yiru Zhang, Linyu Yao, Qun Yang |
| 2024 | Improving child speech recognition with augmented child-like speech. | Yuanyuan Zhang, Zhengjun Yue, Tanvina Patel, Odette Scharenborg |
| 2024 | BS-PLCNet 2: Two-stage Band-split Packet Loss Concealment Network with Intra-model Knowledge Distillation. | Zihan Zhang, Xianjun Xia, Chuanzeng Huang, Yijian Xiao, Lei Xie |
| 2024 | Spoof Diarization: "What Spoofed When" in Partially Spoofed Audio. | Lin Zhang, Xin Wang, Erica Cooper, Mireia Dez, Federico Landini, Nicholas W. D. Evans, Junichi Yamagishi |
| 2024 | URGENT Challenge: Universality, Robustness, and Generalizability For Speech Enhancement. | Wangyou Zhang, Robin Scheibler, Kohei Saijo, Samuele Cornell, Chenda Li, Zhaoheng Ni, Jan Pirklbauer, Marvin Sach, Shinji Watanabe, Tim Fingscheidt, Yanmin Qian |
| 2024 | Beyond Performance Plateaus: A Comprehensive Study on Scalability in Speech Enhancement. | Wangyou Zhang, Kohei Saijo, Jee-weon Jung, Chenda Li, Shinji Watanabe, Yanmin Qian |
| 2024 | Linear-Complexity Self-Supervised Learning for Speech Processing. | Shucong Zhang, Titouan Parcollet, Rogier van Dalen, Sourav Bhattacharya |
| 2024 | Variable Segment Length and Domain-Adapted Feature Optimization for Speaker Diarization. | Chenyuan Zhang, Linkai Luo, Hong Peng, Wei Wen |
| 2024 | Prosody of speech production in latent post-stroke aphasia. | Cong Zhang, Tong Li, Gayle DeDe, Christos Salis |
| 2024 | Transmitted and Aggregated Self-Attention for Automatic Speech Recognition. | Tian-Hao Zhang, Xinyuan Qian, Feng Chen, Xu-Cheng Yin |
| 2024 | Non-Intrusive Speech Intelligibility Prediction for Hearing Aids using Whisper and Metadata. | Ryandhimas E. Zezario, Fei Chen, Chiou-Shann Fuh, Hsin-Min Wang, Yu Tsao |
| 2024 | CtrSVDD: A Benchmark Dataset and Baseline Analysis for Controlled Singing Voice Deepfake Detection. | Yongyi Zang, Jiatong Shi, You Zhang, Ryuichi Yamamoto, Jionghao Han, Yuxun Tang, Shengyuan Xu, Wenxiao Zhao, Jing Guo, Tomoki Toda, Zhiyao Duan |
| 2024 | Cross-Linguistic Intelligibility of Non-Compositional Expressions in Spoken Context. | Iuliia Zaitova, Irina Stenger, Wei Xue, Tania Avgustinova, Bernd Mbius, Dietrich Klakow |
| 2024 | Automatic Assessment of Dysarthria using Speech and synthetically generated Electroglottograph signal. | Fathima Zaheera, Supritha Shetty, Gayadhar Pradhan, Deepak K. T |
| 2024 | Pretraining End-to-End Keyword Search with Automatically Discovered Acoustic Units. | Bolaji Yusuf, Jan Honza Cernock, Murat Saralar |
| 2024 | Speculative Speech Recognition by Audio-Prefixed Low-Rank Adaptation of Language Models. | Bolaji Yusuf, Murali Karthick Baskar, Andrew Rosenberg, Bhuvana Ramabhadran |