| 2026 | ACL | Beyond Sentence-level Labels: Integrating Conversational Context and Personal Experience for Natural Emotional Expression. | Haiyang Sun, Chenyang Le, Wei Wang, Leying Zhang, Chuang Li, Bing Han, Chenda Li, Mengxiao Bi, Yanmin Qian |
| 2025 | ICASSP | SLIDE: Integrating Speech Language Model with LLM for Spontaneous Spoken Dialogue Generation. | Haitian Lu, Gaofeng Cheng, Liuping Luo, Leying Zhang, Yanmin Qian, Pengyuan Zhang |
| 2025 | ICASSP | Advanced Zero-Shot Text-to-Speech for Background Removal and Preservation with Controllable Masked Speech Prediction. | Leying Zhang, Wangyou Zhang, Zhengyang Chen, Yanmin Qian |
| 2025 | Interspeech | E2E-BPVC: End-to-End Background-Preserving Voice Conversion via In-Context Learning. | Yihan Liu, Zhengyang Chen, Leying Zhang, Yanmin Qian |
| 2024 | ICASSP | Generation-Based Target Speech Extraction with Speech Discretization and Vocoder. | Linfeng Yu, Wangyou Zhang, Chenpeng Du, Leying Zhang, Zheng Liang, Yanmin Qian |
| 2024 | ICLR | PromptTTS 2: Describing and Generating Voices with Text Prompt. | Yichong Leng, Zhifang Guo, Kai Shen, Zeqian Ju, Xu Tan, Eric Liu, Yufei Liu, Dongchao Yang, Leying Zhang, Kaitao Song, Lei He, Xiangyang Li, Sheng Zhao, Tao Qin, Jiang Bian |
| 2023 | ICASSP | Adaptive Large Margin Fine-Tuning For Robust Speaker Verification. | Leying Zhang, Zhengyang Chen, Yanmin Qian |
| 2022 | Interspeech | Enroll-Aware Attentive Statistics Pooling for Target Speaker Verification. | Leying Zhang, Zhengyang Chen, Yanmin Qian |
| 2021 | Interspeech | Knowledge Distillation from Multi-Modality to Single-Modality for Person Verification. | Leying Zhang, Zhengyang Chen, Yanmin Qian |