| 2025 | ICASSP | Dynamic Language Group-based MoE: Enhancing Code-Switching Speech Recognition with Hierarchical Routing. | Hukai Huang, Shenghui Lu, Yahui Shan, He Qu, Fengrun Zhang, Wenhao Guan, Qingyang Hong, Lin Li |
| 2025 | ICASSP | Boosting Code-Switching ASR with Mixture of Experts Enhanced Speech-Conditioned LLM. | Fengrun Zhang, Wang Geng, Hukai Huang, Yahui Shan, Cheng Yi, He Qu |
| 2025 | Interspeech | DS-Codec: Dual-Stage Training with Mirror-to-NonMirror Architecture Switching for Speech Codec. | Peijie Chen, Wenhao Guan, Kaidi Wang, Weijie Wu, Hukai Huang, Qingyang Hong, Lin Li |
| 2025 | Interspeech | A Two-Stage Hierarchical Deep Filtering Framework for Real-Time Speech Enhancement. | Shenghui Lu, Hukai Huang, Jinanglong Yao, Kaidi Wang, Qingyang Hong, Lin Li |
| 2025 | Interspeech | Discl-VC: Disentangled Discrete Tokens and In-Context Learning for Controllable Zero-Shot Voice Conversion. | Kaidi Wang, Wenhao Guan, Ziyue Jiang, Hukai Huang, Peijie Chen, Weijie Wu, Qingyang Hong, Lin Li |
| 2024 | AAAI | MM-TTS: Multi-Modal Prompt Based Style Transfer for Expressive Text-to-Speech Synthesis. | Wenhao Guan, Yishuang Li, Tao Li, Hukai Huang, Feng Wang, Jiayan Lin, Lingyan Huang, Lin Li, Qingyang Hong |
| 2024 | ICASSP | SR-HuBERT : An Efficient Pre-Trained Model for Speaker Verification. | Yishuang Li, Hukai Huang, Zhicong Chen, Wenhao Guan, Jiayan Lin, Lin Li, Qingyang Hong |
| 2024 | Interspeech | Efficient Integrated Features Based on Pre-trained Models for Speaker Verification. | Yishuang Li, Wenhao Guan, Hukai Huang, Shiyu Miao, Qi Su, Lin Li, Qingyang Hong |
| 2024 | Interspeech | MinSpeech: A Corpus of Southern Min Dialect for Automatic Speech Recognition. | Jiayan Lin, Shenghui Lu, Hukai Huang, Wenhao Guan, Binbin Xu, Hui Bu, Qingyang Hong, Lin Li |
| 2023 | Interspeech | Interpretable Style Transfer for Text-to-Speech with ControlVAE and Diffusion Bridge. | Wenhao Guan, Tao Li, Yishuang Li, Hukai Huang, Qingyang Hong, Lin Li |