| 2025 | ACL | Towards Dynamic Theory of Mind: Evaluating LLM Adaptation to Temporal Evolution of Human States. | Yang Xiao, Jiashuo Wang, Qiancheng Xu, Changhe Song, Chunpu Xu, Yi Cheng, Wenjie Li, Pengfei Liu |
| 2025 | ICASSP | Binary Representation Learning for Discriminative Acoustic Unit Discovery. | Rui Niu, Jie Chen, Long Ma, Changhe Song, Weihao Wu, Zhiyong Wu |
| 2024 | IJCNN | Representation Space Maintenance: Against Forgetting in Continual Learning. | Rui Niu, Zhiyong Wu, Changhe Song |
| 2023 | Interspeech | SememeASR: Boosting Performance of End-to-End Speech Recognition against Domain and Long-Tailed Data Shift with Sememe Semantic Knowledge. | Jiaxu Zhu, Changhe Song, Zhiyong Wu, Helen Meng |
| 2023 | Interspeech | Text-Only Domain Adaptation for End-to-End Speech Recognition through Down-Sampling Acoustic Representation. | Jiaxu Zhu, Weinan Tong, Yaoxun Xu, Changhe Song, Zhiyong Wu, Zhao You, Dan Su, Dong Yu, Helen Meng |
| 2022 | ICASSP | A Character-Level Span-Based Model for Mandarin Prosodic Structure Prediction. | Xueyuan Chen, Changhe Song, Yixuan Zhou, Zhiyong Wu, Changbin Chen, Zhongqin Wu, Helen Meng |
| 2022 | ICASSP | An End-to-End Chinese Text Normalization Model Based on Rule-Guided Flat-Lattice Transformer. | Wenlin Dai, Changhe Song, Xiang Li, Zhiyong Wu, Huashan Pan, Xiulin Li, Helen Meng |
| 2022 | ICASSP | Disentangling Content and Fine-Grained Prosody Information Via Hybrid ASR Bottleneck Features for Voice Conversion. | Xintao Zhao, Feng Liu, Changhe Song, Zhiyong Wu, Shiyin Kang, Deyi Tuo, Helen Meng |
| 2022 | Interspeech | Improving Mandarin Prosodic Structure Prediction with Multi-level Contextual Information. | Jie Chen, Changhe Song, Deyi Tuo, Xixin Wu, Shiyin Kang, Zhiyong Wu, Helen Meng |
| 2022 | Interspeech | Towards Cross-speaker Reading Style Transfer on Audiobook Dataset. | Xiang Li, Changhe Song, Xianhao Wei, Zhiyong Wu, Jia Jia, Helen Meng |
| 2022 | Interspeech | Enhancing Word-Level Semantic Representation via Dependency Structure for Expressive Text-to-Speech Synthesis. | Yixuan Zhou, Changhe Song, Jingbei Li, Zhiyong Wu, Yanyao Bian, Dan Su, Helen Meng |
| 2022 | Interspeech | Content-Dependent Fine-Grained Speaker Embedding for Zero-Shot Speaker Adaptation in Text-to-Speech Synthesis. | Yixuan Zhou, Changhe Song, Xiang Li, Luwen Zhang, Zhiyong Wu, Yanyao Bian, Dan Su, Helen Meng |
| 2021 | ICASSP | Syntactic Representation Learning For Neural Network Based TTS with Syntactic Parse Tree Traversal. | Changhe Song, Jingbei Li, Yixuan Zhou, Zhiyong Wu, Helen M. Meng |
| 2021 | Interspeech | Towards Multi-Scale Style Control for Expressive Speech Synthesis. | Xiang Li, Changhe Song, Jingbei Li, Zhiyong Wu, Jia Jia, Helen Meng |