| 2025 | ICASSP | LEF-TTS: Lightweight and Efficient End-to-End Text-to-Speech Synthesis With Multi-Stream Generator. | Yan Shi, Jin Shi, Minchuan Chen, Chenfeng Miao, Ming Fang, Ning Cheng, Shaojun Wang, Jing Xiao |
| 2025 | ICASSP | Self-Enhanced Reasoning Training: Activating Latent Reasoning in Small Models for Enhanced Reasoning Distillation. | Yong Zhang, Bingyuan Zhang, Zhitao Li, Ming Li, Ning Cheng, Minchuan Chen, Tao Wei, Jun Ma, Shaojun Wang, Jing Xiao |
| 2024 | ICASSP | ESVC: Combining Adaptive Style Fusion and Multi-Level Feature Disentanglement for Expressive Singing Voice Conversion. | Zeyu Yang, Minchuan Chen, Yanping Li, Wei Hu, Shaojun Wang, Jing Xiao, Zijian Li |
| 2024 | ICML | DFlow: A Generative Model Combining Denoising AutoEncoder and Normalizing Flow for High Fidelity Waveform Generation. | Chenfeng Miao, Qingying Zhu, Minchuan Chen, Wei Hu, Zijian Li, Shaojun Wang, Jing Xiao |
| 2024 | Interspeech | Improving Multilingual Text-to-Speech with Mixture-of-Language-Experts and Accent Disentanglement. | Jing Wu, Ting Chen, Minchuan Chen, Wei Hu, Shaojun Wang, Jing Xiao |
| 2023 | Interspeech | Exploring multi-task learning and data augmentation in dementia detection with self-supervised pretrained models. | Minchuan Chen, Chenfeng Miao, Jun Ma, Shaojun Wang, Jing Xiao |
| 2022 | Interspeech | A compact transformer-based GAN vocoder. | Chenfeng Miao, Ting Chen, Minchuan Chen, Jun Ma, Shaojun Wang, Jing Xiao |
| 2021 | ACL | PHMOSpell: Phonological and Morphological Knowledge Guided Chinese Spelling Check. | Li Huang, Junjie Li, Weiwei Jiang, Zhiyu Zhang, Minchuan Chen, Shaojun Wang, Jing Xiao |
| 2021 | ICASSP | Improving Neural Text Normalization with Partial Parameter Generator and Pointer-Generator Network. | Weiwei Jiang, Junjie Li, Minchuan Chen, Jun Ma, Shaojun Wang, Jing Xiao |
| 2021 | ICASSP | Unsupervised Learning for Multi-Style Speech Synthesis with Limited Data. | Shuang Liang, Chenfeng Miao, Minchuan Chen, Jun Ma, Shaojun Wang, Jing Xiao |
| 2021 | ICML | EfficientTTS: An Efficient and High-Quality Text-to-Speech Architecture. | Chenfeng Miao, Shuang Liang, Zhengchen Liu, Minchuan Chen, Jun Ma, Shaojun Wang, Jing Xiao |
| 2021 | Interspeech | EfficientSing: A Chinese Singing Voice Synthesis System Using Duration-Free Acoustic Model and HiFi-GAN Vocoder. | Zhengchen Liu, Chenfeng Miao, Qingying Zhu, Minchuan Chen, Jun Ma, Shaojun Wang, Jing Xiao |
| 2021 | Interspeech | Improving Polyphone Disambiguation for Mandarin Chinese by Combining Mix-Pooling Strategy and Window-Based Attention. | Junjie Li, Zhiyu Zhang, Minchuan Chen, Jun Ma, Shaojun Wang, Jing Xiao |
| 2020 | ICASSP | Flow-TTS: A Non-Autoregressive Network for Text to Speech Based on Flow. | Chenfeng Miao, Shuang Liang, Minchuan Chen, Jun Ma, Shaojun Wang, Jing Xiao |
| 2020 | Interspeech | Nonparallel Emotional Speech Conversion Using VAE-GAN. | Yuexin Cao, Zhengchen Liu, Minchuan Chen, Jun Ma, Shaojun Wang, Jing Xiao |
| 2020 | Interspeech | Non-Parallel Voice Conversion with Fewer Labeled Data by Conditional Generative Adversarial Networks. | Minchuan Chen, Weijian Hou, Jun Ma, Shaojun Wang, Jing Xiao |
| 2019 | Interspeech | Cross-Lingual, Multi-Speaker Text-To-Speech Synthesis Using Neural Speaker Embedding. | Mengnan Chen, Minchuan Chen, Shuang Liang, Jun Ma, Lei Chen, Shaojun Wang, Jing Xiao |