| 2026 | AAAI | HQ-SVC: Towards High-Quality Zero-Shot Singing Voice Conversion in Low-Resource Scenarios. | Bingsong Bai, Yizhong Geng, Fengping Wang, Cong Wang, Puyuan Guo, Yingming Gao, Ya Li |
| 2025 | AAAI | Controllable 3D Dance Generation Using Diffusion-Based Transformer U-Net. | Puyuan Guo, Tuo Hao, Wenxin Fu, Yingming Gao, Ya Li |
| 2025 | ACL | Beyond Surface Simplicity: Revealing Hidden Reasoning Attributes for Precise Commonsense Diagnosis. | Huijun Lian, Zekai Sun, Keqi Chen, Yingming Gao, Ya Li |
| 2025 | ICASSP | DetailTTS: Learning Residual Detail Information for Zero-shot Text-to-speech. | Cong Wang, Yichen Han, Yizhong Geng, Yingming Gao, Fengping Wang, Bingsong Bai, Qifei Li, Jinlong Xue, Yayue Deng, Zhengqi Wen, Ya Li |
| 2025 | Interspeech | EEG-based Voice Conversion : Hearing the Voice of Your Brain. | Yizhong Geng, Wenxin Fu, Qihang Lu, Bingsong Bai, Cong Wang, Yingming Gao, Ya Li |
| 2024 | ICASSP | Concss: Contrastive-based Context Comprehension for Dialogue-Appropriate Prosody in Conversational Speech Synthesis. | Yayue Deng, Jinlong Xue, Yukang Jia, Qifei Li, Yichen Han, Fengping Wang, Yingming Gao, Dengfeng Ke, Ya Li |
| 2024 | ICASSP | Frame-Level Emotional State Alignment Method for Speech Emotion Recognition. | Qifei Li, Yingming Gao, Cong Wang, Yayue Deng, Jinlong Xue, Yichen Han, Ya Li |
| 2024 | Interspeech | SPA-SVC: Self-supervised Pitch Augmentation for Singing Voice Conversion. | Bingsong Bai, Fengping Wang, Yingming Gao, Ya Li |
| 2024 | Interspeech | Enhancing Modal Fusion by Alignment and Label Matching for Multimodal Emotion Recognition. | Qifei Li, Yingming Gao, Yuhua Wen, Cong Wang, Ya Li |
| 2024 | Interspeech | Retrieval Augmented Generation in Prompt-based Text-to-Speech Synthesis with Context-Aware Contrastive Language-Audio Pretraining. | Jinlong Xue, Yayue Deng, Yingming Gao, Ya Li |
| 2024 | Interspeech | Improving Audio Codec-based Zero-Shot Text-to-Speech Synthesis with Multi-Modal Context and Large Language Model. | Jinlong Xue, Yayue Deng, Yicheng Han, Yingming Gao, Ya Li |
| 2023 | ICASSP | M | Jinlong Xue, Yayue Deng, Fengping Wang, Ya Li, Yingming Gao, Jianhua Tao, Jianqing Sun, Jiaen Liang |
| 2023 | Interspeech | Dual Audio Encoders Based Mandarin Prosodic Boundary Prediction by Using Multi-Granularity Prosodic Representations. | Ruishan Li, Yingming Gao, Yanlu Xie, Dengfeng Ke, Jinsong Zhang |
| 2023 | Interspeech | FTA-net: A Frequency and Time Attention Network for Speech Depression Detection. | Qifei Li, Dong Wang, Yiming Ren, Yingming Gao, Ya Li |
| 2022 | Interspeech | A study of production error analysis for Mandarin-speaking Children with Hearing Impairment. | Jingwen Cheng, Yuchen Yan, Yingming Gao, Xiaoli Feng, Yannan Wang, Jinsong Zhang |
| 2022 | MMSP | A Keypoint Based Enhancement Method for Audio Driven Free View Talking Head Synthesis. | Yichen Han, Ya Li, Yingming Gao, Jinlong Xue, Songpo Wang, Lei Yang |
| 2020 | Interspeech | Formant Tracking Using Dilated Convolutional Networks Through Dense Connection with Gating Mechanism. | Wang Dai, Jinsong Zhang, Yingming Gao, Wei Wei, Dengfeng Ke, Binghuai Lin, Yanlu Xie |
| 2020 | Interspeech | An Investigation of the Target Approximation Model for Tone Modeling and Recognition in Continuous Mandarin Speech. | Yingming Gao, Xinyu Zhang, Yi Xu, Jinsong Zhang, Peter Birkholz |
| 2019 | Interspeech | Articulatory Copy Synthesis Based on a Genetic Algorithm. | Yingming Gao, Simon Stone, Peter Birkholz |
| 2015 | Interspeech | A study on robust detection of pronunciation erroneous tendency based on deep neural network. | Yingming Gao, Yanlu Xie, Wen Cao, Jinsong Zhang |