| 2025 | Lateral Channel Formation in Australian English /l/: Insights from Magnetic Resonance Imaging. | Tnde Szalay, Michael Proctor, Amelia Gully, Tharinda Piyadasa, Craig T. Jin, David Waddington, Naeim Sanaei, Sheryl Foster, Kirrie J. Ballard |
| 2025 | DiffEmotionVC: A Dual-Granularity Disentangled Diffusion Framework for Any-to-Any Emotional Voice Conversion. | Xiaosu Su, Bowen Yang, Xiaowei Yi, Yun Cao |
| 2025 | Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM. | Zhaokai Sun, Li Zhang, Qing Wang, Pan Zhou, Lei Xie |
| 2025 | RA-CLAP: Relation-Augmented Emotional Speaking Style Contrastive Language-Audio Pretraining For Speech Retrieval. | Haoqin Sun, Jingguang Tian, Jiaming Zhou, Hui Wang, Jiabei He, Shiwan Zhao, Xiangyu Kong, Desheng Hu, Xinkang Xu, Xinhui Hu, Yong Qin |
| 2025 | Apical vs. Regular Vowel Duration: A Corpus-based Analysis of Contextual Influences in Standard Mandarin. | Jingyi Sun, Bowei Shao, Martine Adda-Decker |
| 2025 | Score-Based Training for Energy-Based TTS Models. | Wanli Sun, Anton Ragni |
| 2025 | Acquiring Pronunciation from Speech Audio via Multi-task Learning. | Siqi Sun, Korin Richmond |
| 2025 | PPGs-BERT: Leveraging Phoneme Sequence and BERT for Alzheimer's Disease Detection from Spontaneous Speech. | Qi Sun, Ziyue Qiu, Yu Pu, Jinpeng Li, Xuchu Chen, Wei-Qiang Zhang |
| 2025 | Scaling beyond Denoising: Submitted System and Findings in URGENT Challenge 2025. | Zhihang Sun, Andong Li, Tong Lei, Rilin Chen, Meng Yu, Chengshi Zheng, Yi Zhou, Dong Yu |
| 2025 | Multitask Learning with Fused Attention for Improved ASR and Mispronunciation Detection in Children's Speech Sound Disorders. | Selina S. Sung, Seunghee Ha, Tae-Jin Yoon, Jungmin So |
| 2025 | Efficient Speech Enhancement via Embeddings from Pre-trained Generative Audioencoders. | Xingwei Sun, Heinrich Dinkel, Yadong Niu, Linzhang Wang, Junbo Zhang, Jian Luan |
| 2025 | Corpus-Based Insights into Mandarin Neutral Tone: Effects of Tonal Context and Structural Patterns in Spontaneous Speech. | Jingyi Sun, Nicolas Audibert, Yaru Wu, Martine Adda-Decker |
| 2025 | Lightweight Speech Enhancement for Mandarin Esophageal Speech. | Jia-Jyu Su, Yen-Ting Lin, Wu-Hao Li, Chao-Kai Chang, Yan-Zhi Chen, Chen-Yu Chiang |
| 2025 | Text-Enhanced Audio Encoder for Large Language Model based Speech Recognition via Cross-Modality Pre-training with Unpaired Audio-Text Data. | Hang Su, Yuxiang Kong, Lichun Fan, Jian Luan |
| 2025 | Cantonese Punctuation Restoration using LLM Annotated Data. | King Yiu Suen, Rudolf Chow, Albert Y. S. Lam |
| 2025 | OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary. | Yui Sudo, Yusuke Fujita, Atsushi Kojima, Tomoya Mizumoto, Lianbo Liu |
| 2025 | DYNAC: Dynamic Vocabulary-based Non-Autoregressive Contextualization for Speech Recognition. | Yui Sudo, Yosuke Fukumoto, Muhammad Shakeel, Yifan Peng, Chyi-Jiunn Lin, Shinji Watanabe |
| 2025 | Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora. | Hitoshi Suda, Shinnosuke Takamichi, Satoru Fukayama |
| 2025 | Length Aware Speech Translation for Video Dubbing. | Aswin Shanmugam Subramanian, Harveen Singh Chadha, Vikas Joshi, Shubham Bansal, Jian Xue, Rupeshkumar Mehta, Jinyu Li |
| 2025 | Improving Practical Aspects of End-to-End Multi-Talker Speech Recognition for Online and Offline Scenarios. | Aswin Shanmugam Subramanian, Amit Das, Naoyuki Kanda, Jinyu Li, Xiaofei Wang, Yifan Gong |
| 2025 | Voice Adaptation for Swiss German. | Samuel Stucki, Jan Deriu, Mark Cieliebak |
| 2025 | Modeling Probabilistic Reduction using Information Theory and Naive Discriminative Learning. | Anna Stein, Kevin Tang |
| 2025 | TADA: Training-free Attribution and Out-of-Domain Detection of Audio Deepfakes. | Adriana Stan, David Combei, Dan Oneata, Horia Cucu |
| 2025 | J-j-j-just Stutter: Benchmarking Whisper's Performance Disparities on Different Stuttering Patterns. | Charan Sridhar, Shaomei Wu |
| 2025 | Performance of Montreal Forced Aligner on Cantonese Spontaneous Speech. | Ka Ki SO, Chenzi Xu, Grace Wenling Cao, Peggy Mok |