| 2025 | ICASSP | Can Automated Speech Recognition Errors Provide Valuable Clues for Alzheimer's Disease Detection? | Yin-Long Liu, Rui Feng, Ye-Xin Lu, Jia-Xin Chen, Yang Ai, Jia-Hong Yuan, Zhen-Hua Ling |
| 2025 | ICASSP | Incremental Disentanglement for Environment-Aware Zero-Shot Text-to-Speech Synthesis. | Ye-Xin Lu, Hui-Peng Du, Zheng-Yan Sheng, Yang Ai, Zhen-Hua Ling |
| 2025 | Interspeech | Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising. | Ye-Xin Lu, Hui-Peng Du, Fei Liu, Yang Ai, Zhen-Hua Ling |
| 2024 | Interspeech | A Low-Bitrate Neural Audio Codec Framework with Bandwidth Reduction and Recovery for High-Sampling-Rate Waveforms. | Yang Ai, Ye-Xin Lu, Xiao-Hang Jiang, Zheng-Yan Sheng, Rui-Chen Zheng, Zhen-Hua Ling |
| 2024 | Interspeech | BiVocoder: A Bidirectional Neural Vocoder Integrating Feature Extraction and Waveform Generation. | Hui-Peng Du, Ye-Xin Lu, Yang Ai, Zhen-Hua Ling |
| 2024 | Interspeech | MultiStage Speech Bandwidth Extension with Flexible Sampling Rate Control. | Ye-Xin Lu, Yang Ai, Zheng-Yan Sheng, Zhen-Hua Ling |
| 2023 | Interspeech | MP-SENet: A Speech Enhancement Model with Parallel Denoising of Magnitude and Phase Spectra. | Ye-Xin Lu, Yang Ai, Zhen-Hua Ling |