| 2022 | Interspeech | A Multi-Stage Multi-Codebook VQ-VAE Approach to High-Performance Neural TTS. | Haohan Guo, Feng-Long Xie, Frank K. Soong, Xixin Wu, Helen Meng |
| 2021 | ICASSP | A New High Quality Trajectory Tiling Based Hybrid TTS In Real Time. | Feng-Long Xie, Xinhui Li, Wen-Chao Su, Li Lu, Frank K. Soong |
| 2020 | ICASSP | An Improved Frame-Unit-Selection Based Voice Conversion System Without Parallel Training Data. | Feng-Long Xie, Xinhui Li, Bo Liu, Yibin Zheng, Li Meng, Li Lu, Frank K. Soong |
| 2016 | ICASSP | A KL divergence and DNN approach to cross-lingual TTS. | Feng-Long Xie, Frank K. Soong, Haifeng Li |
| 2016 | Interspeech | A KL Divergence and DNN-Based Approach to Voice Conversion without Parallel Training Sentences. | Feng-Long Xie, Frank K. Soong, Haifeng Li |
| 2014 | Interspeech | TTS synthesis with bidirectional LSTM based recurrent neural networks. | Yuchen Fan, Yao Qian, Feng-Long Xie, Frank K. Soong |
| 2014 | Interspeech | Sequence error (SE) minimization training of neural network for voice conversion. | Feng-Long Xie, Yao Qian, Yuchen Fan, Frank K. Soong, Haifeng Li |