| 2020 | ICASSP | Improving Prosody with Linguistic and Bert Derived Features in Multi-Speaker Based Mandarin Chinese Neural TTS. | Yujia Xiao, Lei He, Huaiping Ming, Frank K. Soong |
| 2017 | ICMI | Audio-visual emotion recognition using deep transfer learning and multiple temporal models. | Xi Ouyang, Shigenori Kawaai, Ester Gue Hua Goh, Shengmei Shen, Wan Ding, Huaiping Ming, Dong-Yan Huang |
| 2017 | Interspeech | Multimodal Prediction of Affective Dimensions via Fusing Multiple Regression Techniques. | Dong-Yan Huang, Wan Ding, Mingyu Xu, Huaiping Ming, Minghui Dong, Xinguo Yu, Haizhou Li |
| 2016 | ICASSP | Exemplar-based sparse representation of timbre and prosody for voice conversion. | Huaiping Ming, Dong-Yan Huang, Lei Xie, Shaofei Zhang, Minghui Dong, Haizhou Li |
| 2016 | Interspeech | Deep Bidirectional LSTM Modeling of Timbre and Prosody for Emotional Voice Conversion. | Huaiping Ming, Dong-Yan Huang, Lei Xie, Jie Wu, Minghui Dong, Haizhou Li |
| 2015 | ACII | Fundamental frequency modeling using wavelets for emotional voice conversion. | Huaiping Ming, Dong-Yan Huang, Minghui Dong, Haizhou Li, Lei Xie, Shaofei Zhang |
| 2015 | Interspeech | An alternating optimization approach for phase retrieval. | Huaiping Ming, Dong-Yan Huang, Lei Xie, Haizhou Li, Minghui Dong |