| 2025 | D-GAT: Dual Graph Attention Network for Global HRTF Interpolation. | Junsheng Hu, Shaojie Li, Qintuya Si, De Hu |
| 2025 | Transcript-Prompted Whisper with Dictionary-Enhanced Decoding for Japanese Speech Annotation. | Rui Hu, Xiaolong Lin, Jiawang Liu, Shixi Huang, Zhenpeng Zhan |
| 2025 | Joint Reference Microphone Selection and Filter Order Determination in Multi-channel Active Noise Control. | De Hu, Shuyao Liu, Yanrong He |
| 2025 | Joint Rate Allocation and Sensor Selection for Speech Enhancement in Wireless Acoustic Sensor Networks. | De Hu, Qilong Li |
| 2025 | Perception of Long and Short Vowel Contrast in Te Reo Māori in Clean and Everyday Listening Environments. | C. T. Justine Hui, Jenice Kuzhikombil, Isabella Shields, Hiraia Haami-Wells, Catherine I. Watson, Peter J. Keegan |
| 2025 | Privacy-Preserving Speaker Verification via End-to-End Secure Representation Learning. | Chenguang Hu, Yaqian Hao, Fulin Zhang, Xiaoxue Luo, Yao Shen, Yingying Gao, Chao Deng, Shilei Zhang, Junlan Feng |
| 2025 | Efficient and Direct Duplex Modeling for Speech-to-Speech Language Model. | Ke Hu, Ehsan Hosseini-Asl, Chen Chen, Edresson Casanova, Subhankar Ghosh, Piotr Zelasko, Zhehuai Chen, Jason Li, Jagadeesh Balam, Boris Ginsburg |
| 2025 | Video-to-Audio Generation with Fine-grained Temporal Semantics. | Yuchen Hu, Yu Gu, Chenxing Li, Rilin Chen, Dong Yu |
| 2025 | Enhancing Lyrics Transcription on Music Mixtures with Consistency Loss. | Jiawen Huang, Felipe Sousa, Emir Demirel, Emmanouil Benetos, Igor Gadelha |
| 2025 | CBA: Backdoor Attack on Deep Speech Classification via Audio Compression. | Yuheng Huang, Ying Ren, Wenjie Zhang, Diqun Yan |
| 2025 | Word-Level Error Analysis in Decoding Systems: From Speech Recognition to Brain-Computer Interfaces. | Jingya Huang, Aashish N. Patel, Sowmya Manojna Narasimha, Gal Mishne, Vikash Gilja |
| 2025 | From Sharpness to Better Generalization for Speech Deepfake Detection. | Wen Huang, Xuechen Liu, Xin Wang, Junichi Yamagishi, Yanmin Qian |
| 2025 | VoiceNoNG: Robust High-Quality Speech Editing Model without Hallucinations. | Sung-Feng Huang, Heng-Cheng Kuo, Zhehuai Chen, Xuesong Yang, Pin-Jui Ku, Ante Jukic, Huck Yang, Yu Tsao, Yu-Chiang Frank Wang, Hung-yi Lee, Szu-Wei Fu |
| 2025 | Articulatory variations in Apical Vowels in Southwestern Mandarin. | Jing Huang, Feng-fan Hsieh, Yueh-Chin Chang |
| 2025 | On the Relationship between Accent Strength and Articulatory Features. | Kevin Huang, Sean Foley, Jihwan Lee, Yoonjeong Lee, Dani Byrd, Shrikanth Narayanan |
| 2025 | Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge. | Shangkun Huang, Yuxuan Du, Jingwen Yang, Dejun Zhang, Xupeng Jia, Jing Deng, Jintao Kang, Rong Zheng |
| 2025 | Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection. | Shangkun Huang, Jing Deng, Jintao Kang, Rong Zheng |
| 2025 | SHEET: A Multi-purpose Open-source Speech Human Evaluation Estimation Toolkit. | Wen-Chin Huang, Erica Cooper, Tomoki Toda |
| 2025 | Vela: Scalable Embeddings with Voice Large Language Models for Multimodal Retrieval. | Ruofan Hu, Yan Xia, Minjie Hong, Jieming Zhu, Bo Chen, Xiaoda Yang, Minghui Fang, Tao Jin |
| 2025 | Instantaneous changes in acoustic signals reflect syllable progression and cross-linguistic syllable variation. | Haley Hsu, Dani Byrd, Khalil Iskarous, Louis Goldstein |
| 2025 | Tonality-Based Accompaniment-Guided Automatic Singing Evaluation. | Pei-Chin Hsieh, Yih-Liang Shen, Ngoc Son Tran, Tai-Shih Chi |
| 2025 | OMPAL: Bridging Speech and Learning with an Open-Source Mandarin Pronunciation Assessment Corpus for Global Learners. | Wen-Wei Hsieh, Hao-Wei Chi, Kuan-Chen Wang, Ping-Cheng Yeh, Te-Hsin Liu, Chen-Yu Chiang |
| 2025 | Dysarthric Speech Recognition Using Curriculum Learning and Multi-stream Architecture. | I-Ting Hsieh, Chung-Hsien Wu |
| 2025 | Analyzing Mitigation Strategies for Catastrophic Forgetting in End-to-End Training of Spoken Language Models. | Chi-Yuan Hsiao, Ke-Han Lu, Kai-Wei Chang, Chih-Kai Yang, Wei-Chih Chen, Hung-yi Lee |
| 2025 | The function of creaky voice in South Korean: A perception study. | Patrik Hrabnek, Michaela Watkins, Silke Hamann |