| 2025 | AAAI | Drop the Beat! Freestyler for Accompaniment Conditioned Rapping Voice Generation. | Ziqian Ning, Shuai Wang, Yuepeng Jiang, Jixun Yao, Lei He, Shifeng Pan, Jie Ding, Lei Xie |
| 2022 | ICASSP | Infergrad: Improving Diffusion Models for Vocoder by Considering Inference in Training. | Zehua Chen, Xu Tan, Ke Wang, Shifeng Pan, Danilo P. Mandic, Lei He, Sheng Zhao |
| 2022 | ICASSP | Prosodyspeech: Towards Advanced Prosody Model for Neural Text-to-Speech. | Yuanhao Yi, Lei He, Shifeng Pan, Xi Wang, Yujia Xiao |
| 2022 | Interspeech | SoftSpeech: Unsupervised Duration Model in FastSpeech 2. | Yuanhao Yi, Lei He, Shifeng Pan, Xi Wang, Yuchao Zhang |
| 2021 | Interspeech | Cross-Speaker Style Transfer with Prosody Bottleneck in Neural Speech Synthesis. | Shifeng Pan, Lei He |
| 2019 | ICASSP | Learning Latent Representations for Style Control and Transfer in End-to-end Speech Synthesis. | Yajie Zhang, Shifeng Pan, Lei He, Zhen-Hua Ling |
| 2019 | Interspeech | Forward-Backward Decoding for Regularizing End-to-End TTS. | Yibin Zheng, Xi Wang, Lei He, Shifeng Pan, Frank K. Soong, Zhengqi Wen, Jianhua Tao |
| 2011 | ACII | The CASIA Audio Emotion Recognition Method for Audio/Visual Emotion Challenge 2011. | Shifeng Pan, Jianhua Tao, Ya Li |
| 2011 | ICASSP | Global variance modeling on frequency domain delta LSP for HMM-based speech synthesis. | Shifeng Pan, Yoshihiko Nankaku, Keiichi Tokuda, Jianhua Tao |
| 2010 | Interspeech | Text-based unstressed syllable prediction in Mandarin. | Ya Li, Jianhua Tao, Meng Zhang, Shifeng Pan, Xiaoying Xu |
| 2010 | Interspeech | A novel hybrid approach for Mandarin speech synthesis. | Shifeng Pan, Meng Zhang, Jianhua Tao |
| 2009 | ACII | A multiple perception model on emotional speech. | Jianhua Tao, Aijun Li, Shifeng Pan |