| 2025 | Unfolding A Few Structures for The Many: Memory-Efficient Compression of Conformer and Speech Foundation Models. | Zhaoqing Li, Haoning Xu, Xurong Xie, Zengrui Jin, Tianzi Wang, Xunying Liu |
| 2025 | Long-Context Speech Synthesis with Context-Aware Memory. | Zhipeng Li, Xiaofen Xing, Jingyuan Xing, Hangrui Hu, Heng Lu, Xiangmin Xu |
| 2025 | Towards One-bit ASR: Extremely Low-bit Conformer Quantization Using Co-training and Stochastic Precision. | Zhaoqing Li, Haoning Xu, Zengrui Jin, Lingwei Meng, Tianzi Wang, Huimeng Wang, Youjun Chen, Mingyu Cui, Shujie Hu, Xunying Liu |
| 2025 | VoiceMark: Zero-Shot Voice Cloning-Resistant Watermarking Approach Leveraging Speaker-Specific Latents. | Haiyun Li, Zhiyong Wu, Xiaofeng Xie, Jingran Xie, Yaoxun Xu, Hanyang Peng |
| 2025 | StarVC: A Unified Auto-Regressive Framework for Joint Text and Speech Generation in Voice Conversion. | Fengjin Li, Jie Wang, Yadong Niu, Yongqing Wang, Meng Meng, Jian Luan, Zhiyong Wu |
| 2025 | Speaker Diarization with Overlapping Community Detection Using Graph Attention Networks and Label Propagation Algorithm. | Zhaoyang Li, Jie Wang, XiaoXiao Li, Wangjie Li, Longjie Luo, Lin Li, Qingyang Hong |
| 2025 | SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms. | Sirui Li, Shuai Wang, Zhijun Liu, Zhongjie Jiang, Yannan Wang, Haizhou Li |
| 2025 | REAL-T: Real Conversational Mixtures for Target Speaker Extraction. | Shaole Li, Shuai Wang, Jiangyu Han, Ke Zhang, Wupeng Wang, Haizhou Li |
| 2025 | The Development of Speech Rhythm in Putonghua-Learning Preschool Children in South Xinjiang Uyghur Autonomous Region of China. | Aijun Li, Zhiwei Wang, Jun Gao, Xin Zhou |
| 2025 | Speech Annotation for A: Accuracy, Access, and Application. | Zirong Li, Hongchen Wu, Yixin Gu, Yao Du, Yang Yue |
| 2025 | A Neural Codec Approach for Noise-Robust Bandwidth Expansion. | Xi Liu, Mu Yang, Szu-Jui Chen, John H. L. Hansen |
| 2025 | MASV: Speaker Verification with Global and Local Context Mamba. | Yang Liu, Li Wan, Yiteng Huang, Ming Sun, Xinhao Mei, Xubo Liu, Yangyang Shi, Florian Metze |
| 2025 | Bridging Speech and Singing: Multi-stage Speech-Prompted Singing Voice Conversion with Speaker Embedding Adaptation. | Mingda Liu, Jiatong Shi |
| 2025 | Addressing Task Conflicts in Stuttering Detection via MMoE-Based Multi-Task Learning. | Xiaokang Liu, Xingfeng Li, Yudong Yang, Lan Wang, Nan Yan |
| 2025 | LIST: Language-Independent Speech Token for Multilingual Speech Synthesis with Language Models. | Chang Liu, Zhen-Hua Ling, Yu Gu |
| 2025 | Leveraging Cascaded Binary Classification and Multimodal Fusion for Dementia Detection through Spontaneous Speech. | Yin-Long Liu, Yuanchao Li, Rui Feng, Liu He, Jia-Xin Chen, Yi-Ming Wang, Yu-Ang Chen, Yan-Han Peng, Jia-Hong Yuan, Zhen-Hua Ling |
| 2025 | CNVSRC 2024: The Second Chinese Continuous Visual Speech Recognition Challenge. | Zehua Liu, Xiaolou Li, Chen Chen, Lantian Li, Dong Wang |
| 2025 | HWB-Net: A Novel High-Performance and Efficient Hybrid Waveform Bandwidth Extension Method. | Xin Liu, Shulin He, Xueliang Zhang |
| 2025 | Augment Mandarin to Cantonese Speech Databases via Retrieval-Augmented Generation and Speech Synthesis. | Fan Liu, Cheng Gong, Boyu Zhu, Ruihao Jing, Chunyu Qiang, Tianrui Wang, Xiao-Lei Zhang, Xuelong Li |
| 2025 | Interactive Fusion of Multi-View Speech Embeddings via Pretrained Large-Scale Speech Models for Speech Emotional Attribute Prediction in Naturalistic Conditions. | Yuyun Liu, Yujia Gu, Jiahao Luo, Wenming Zheng, Cheng Lu, Yuan Zong |
| 2025 | Sentence-Final Particles in Mandarin Child-Directed Speech: Frequency and Impact on Speech Rate. | Yizhi Liu, Luyuan Geng, Yan Gu, Mengru Han |
| 2025 | Beyond Manual Transcripts: The Potential of Automated Speech Recognition Errors in Improving Alzheimer's Disease Detection. | Yin-Long Liu, Rui Feng, Jia-Xin Chen, Yi-Ming Wang, Jia-Hong Yuan, Zhen-Hua Ling |
| 2025 | E2E-BPVC: End-to-End Background-Preserving Voice Conversion via In-Context Learning. | Yihan Liu, Zhengyang Chen, Leying Zhang, Yanmin Qian |
| 2025 | Unlearning LLM-Based Speech Recognition Models. | Zhe Liu |
| 2025 | Efficient Multilingual ASR Finetuning via LoRA Language Experts. | Jiahong Li, Yiwen Shao, Jianheng Zhuo, Chenda Li, Liliang Tang, Dong Yu, Yanmin Qian |