| 2026 | ACL | UltraEval-Audio: A Unified Framework for Comprehensive Evaluation of Audio Foundation Models. | Qundong Shi, Jie Zhou, Biyuan Lin, Junbo Cui, Guoyang Zeng, Yixuan Zhou, Ziyang Wang, Xin Liu, Zhen Luo, Yudong Wang, Zhiyuan Liu |
| 2025 | HCI | Exploring the Immersive Gaming Journey: A Virtual Reality and Eye-Tracking Rehabilitation System for Pediatric Amblyopia. | Ziqi Guo, Yixuan Zhou |
| 2025 | ICASSP | DiffCSS: Diverse and Expressive Conversational Speech Synthesis with Diffusion Models. | Weihao Wu, Zhiwei Lin, Yixuan Zhou, Jingbei Li, Rui Niu, Qinghua Wu, Songjun Cao, Long Ma, Zhiyong Wu |
| 2025 | ICLR | TAU-106K: A New Dataset for Comprehensive Understanding of Traffic Accident. | Yixuan Zhou, Long Bai, Sijia Cai, Bing Deng, Xing Xu, Heng Tao Shen |
| 2025 | Interspeech | In This Environment, As That Speaker: A Text-Driven Framework for Multi-Attribute Speech Conversion. | Jiawei Jin, Zhihan Yang, Yixuan Zhou, Zhiyong Wu |
| 2025 | IROS | Zero-Shot Temporal Interaction Localization for Egocentric Videos. | Erhang Zhang, Junyi Ma, Yin-Dong Zheng, Yixuan Zhou, Fan Xu |
| 2024 | ICASSP | Improving Language Model-Based Zero-Shot Text-to-Speech Synthesis with Multi-Scale Acoustic Prompts. | Shun Lei, Yixuan Zhou, Liyang Chen, Dan Luo, Zhiyong Wu, Xixin Wu, Shiyin Kang, Tao Jiang, Yahui Zhou, Yuxing Han, Helen Meng |
| 2024 | ICASSP | The THU-HCSI Multi-Speaker Multi-Lingual Few-Shot Voice Cloning System for LIMMITS'24 Challenge. | Yixuan Zhou, Shuoyi Zhou, Shun Lei, Zhiyong Wu, Menglin Wu |
| 2024 | Interspeech | Spontaneous Style Text-to-Speech Synthesis with Controllable Spontaneous Behaviors Based on Language Models. | Weiqin Li, Peiji Yang, Yicheng Zhong, Yixuan Zhou, Zhisheng Wang, Zhiyong Wu, Xixin Wu, Helen Meng |
| 2023 | HCI | Building Experience Management Body of Knowledge: Responding to the Challenge. | Manhai Li, Yixuan Zhou, Lianyu Huang, Haiwei Wu |
| 2023 | ICASSP | Context-Aware Coherent Speaking Style Prediction with Hierarchical Transformers for Audiobook Speech Synthesis. | Shun Lei, Yixuan Zhou, Liyang Chen, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2023 | ICCV | ImbSAM: A Closer Look at Sharpness-Aware Minimization in Class-Imbalanced Recognition. | Yixuan Zhou, Yi Qu, Xing Xu, Hengtao Shen |
| 2023 | Interspeech | Towards Spontaneous Style Modeling with Semi-supervised Pre-training for Conversational Text-to-Speech Synthesis. | Weiqin Li, Shun Lei, Qiaochu Huang, Yixuan Zhou, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2022 | ICASSP | A Character-Level Span-Based Model for Mandarin Prosodic Structure Prediction. | Xueyuan Chen, Changhe Song, Yixuan Zhou, Zhiyong Wu, Changbin Chen, Zhongqin Wu, Helen Meng |
| 2022 | ICASSP | Towards Expressive Speaking Style Modelling with Hierarchical Context Information for Mandarin Speech Synthesis. | Shun Lei, Yixuan Zhou, Liyang Chen, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2022 | Interspeech | Towards Multi-Scale Speaking Style Modelling with Hierarchical Context Information for Mandarin Speech Synthesis. | Shun Lei, Yixuan Zhou, Liyang Chen, Jiankun Hu, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2022 | Interspeech | Enhancing Word-Level Semantic Representation via Dependency Structure for Expressive Text-to-Speech Synthesis. | Yixuan Zhou, Changhe Song, Jingbei Li, Zhiyong Wu, Yanyao Bian, Dan Su, Helen Meng |
| 2022 | Interspeech | Content-Dependent Fine-Grained Speaker Embedding for Zero-Shot Speaker Adaptation in Text-to-Speech Synthesis. | Yixuan Zhou, Changhe Song, Xiang Li, Luwen Zhang, Zhiyong Wu, Yanyao Bian, Dan Su, Helen Meng |
| 2021 | ICASSP | Syntactic Representation Learning For Neural Network Based TTS with Syntactic Parse Tree Traversal. | Changhe Song, Jingbei Li, Yixuan Zhou, Zhiyong Wu, Helen M. Meng |