| 2026 | AAAI | HPSU: A Benchmark for Human-Level Perception in Real-World Spoken Speech Understanding. | Chen Li, Peiji Yang, Yicheng Zhong, Jianxing Yu, Zhisheng Wang, Zihao Gou, Wenqing Chen, Jian Yin |
| 2026 | ACL | TellWhisper: Tell Whisper Who Speaks When. | Yifan Hu, Peiji Yang, Zhisheng Wang, Yicheng Zhong, Rui Liu |
| 2025 | EMNLP | Eliciting Implicit Acoustic Styles from Open-domain Instructions to Facilitate Fine-grained Controllable Generation of Speech. | Jianxing Yu, Zihao Gou, Chen Li, Zhisheng Wang, Peiji Yang, Wenqing Chen, Jian Yin |
| 2024 | AAAI | ExpCLIP: Bridging Text and Facial Expressions via Semantic Alignment. | Yicheng Zhong, Huawei Wei, Peiji Yang, Zhisheng Wang |
| 2024 | Interspeech | Spontaneous Style Text-to-Speech Synthesis with Controllable Spontaneous Behaviors Based on Language Models. | Weiqin Li, Peiji Yang, Yicheng Zhong, Yixuan Zhou, Zhisheng Wang, Zhiyong Wu, Xixin Wu, Helen Meng |
| 2023 | ICCV | Semi-supervised Speech-driven 3D Facial Animation via Cross-modal Encoding. | Peiji Yang, Huawei Wei, Yicheng Zhong, Zhisheng Wang |
| 2021 | ACL | Cross-lingual Text Classification with Heterogeneous Graph Neural Network. | Ziyun Wang, Xuan Liu, Peiji Yang, Shixing Liu, Zhisheng Wang |