| 2025 | ICASSP | DiffCSS: Diverse and Expressive Conversational Speech Synthesis with Diffusion Models. | Weihao Wu, Zhiwei Lin, Yixuan Zhou, Jingbei Li, Rui Niu, Qinghua Wu, Songjun Cao, Long Ma, Zhiyong Wu |
| 2022 | ICASSP | Enhancing Speaking Styles in Conversational Text-to-Speech Synthesis with Graph-Based Multi-Modal Context Modeling. | Jingbei Li, Yi Meng, Chenyi Li, Zhiyong Wu, Helen Meng, Chao Weng, Dan Su |
| 2022 | ICASSP | Neufa: Neural Network Based End-to-End Forced Alignment with Bidirectional Attention Mechanism. | Jingbei Li, Yi Meng, Zhiyong Wu, Helen Meng, Qiao Tian, Yuping Wang, Yuxuan Wang |
| 2022 | Interspeech | Enhancing Word-Level Semantic Representation via Dependency Structure for Expressive Text-to-Speech Synthesis. | Yixuan Zhou, Changhe Song, Jingbei Li, Zhiyong Wu, Yanyao Bian, Dan Su, Helen Meng |
| 2021 | ICASSP | Emotion Controllable Speech Synthesis Using Emotion-Unlabeled Dataset with the Assistance of Cross-Domain Speech Emotion Recognition. | Xiong Cai, Dongyang Dai, Zhiyong Wu, Xiang Li, Jingbei Li, Helen Meng |
| 2021 | ICASSP | Syntactic Representation Learning For Neural Network Based TTS with Syntactic Parse Tree Traversal. | Changhe Song, Jingbei Li, Yixuan Zhou, Zhiyong Wu, Helen M. Meng |
| 2021 | ICIG | Joint Face Detection and Landmark Localization Based on an Extremely Lightweight Network. | Yuxiang Liu, Chen Chen, Maojun Zhang, Jingbei Li, Wei Xu |
| 2021 | Interspeech | Towards Multi-Scale Style Control for Expressive Speech Synthesis. | Xiang Li, Changhe Song, Jingbei Li, Zhiyong Wu, Jia Jia, Helen Meng |
| 2021 | Interspeech | Adversarially Learning Disentangled Speech Representations for Robust Multi-Factor Voice Conversion. | Jie Wang, Jingbei Li, Xintao Zhao, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2019 | Interspeech | Knowledge-Based Linguistic Encoding for End-to-End Mandarin Text-to-Speech Synthesis. | Jingbei Li, Zhiyong Wu, Runnan Li, Pengpeng Zhi, Song Yang, Helen Meng |