| 2024 | Interspeech | Text-aware and Context-aware Expressive Audiobook Speech Synthesis. | Dake Guo, Xinfa Zhu, Liumeng Xue, Yongmao Zhang, Wenjie Tian, Lei Xie |
| 2023 | ASRU | Promptspeaker: Speaker Generation Based on Text Descriptions. | Yongmao Zhang, Guanghou Liu, Yi Lei, Yunlin Chen, Hao Yin, Lei Xie, Zhifei Li |
| 2023 | ICASSP | DSPGAN: A Gan-Based Universal Vocoder for High-Fidelity TTS by Time-Frequency Domain Supervision from DSP. | Kun Song, Yongmao Zhang, Yi Lei, Jian Cong, Hanzhao Li, Lei Xie, Gang He, Jinfeng Bai |
| 2023 | ICASSP | Multi-Speaker Expressive Speech Synthesis via Multiple Factors Decoupling. | Xinfa Zhu, Yi Lei, Kun Song, Yongmao Zhang, Tao Li, Lei Xie |
| 2023 | Interspeech | PromptStyle: Controllable Style Transfer for Text-to-Speech with Natural Language Descriptions. | Guanghou Liu, Yongmao Zhang, Yi Lei, Yunlin Chen, Rui Wang, Lei Xie, Zhifei Li |
| 2023 | Interspeech | VISinger2: High-Fidelity End-to-End Singing Voice Synthesis Enhanced by Digital Signal Processing Synthesizer. | Yongmao Zhang, Heyang Xue, Hanzhao Li, Lei Xie, Tingwei Guo, Ruixiong Zhang, Caixia Gong |
| 2022 | ICASSP | VISinger: Variational Inference with Adversarial Learning for End-to-End Singing Voice Synthesis. | Yongmao Zhang, Jian Cong, Heyang Xue, Lei Xie, Pengcheng Zhu, Mengxiao Bi |
| 2022 | Interspeech | Opencpop: A High-Quality Open Source Chinese Popular Song Corpus for Singing Voice Synthesis. | Yu Wang, Xinsheng Wang, Pengcheng Zhu, Jie Wu, Hanzhao Li, Heyang Xue, Yongmao Zhang, Lei Xie, Mengxiao Bi |
| 2022 | Interspeech | Learn2Sing 2.0: Diffusion and Mutual Information-Based Target Speaker SVS by Learning from Singing Teacher. | Heyang Xue, Xinsheng Wang, Yongmao Zhang, Lei Xie, Pengcheng Zhu, Mengxiao Bi |