| 2026 | ACL | UniSRM: A Unified Speech Reward Model for Reasoning-Based Fine-grained Assessment. | Yuanyuan Wang, Dongchao Yang, Yayue Deng, Zhiyong Wu, Steven Y. Guo, Helen M. Meng, Xixin Wu |
| 2025 | EMNLP | MemeArena: Automating Context-Aware Unbiased Evaluation of Harmfulness Understanding for Multimodal Large Language Models. | Zixin Chen, Hongzhan Lin, Kaixin Li, Ziyang Luo, Yayue Deng, Jing Ma |
| 2025 | ICASSP | DetailTTS: Learning Residual Detail Information for Zero-shot Text-to-speech. | Cong Wang, Yichen Han, Yizhong Geng, Yingming Gao, Fengping Wang, Bingsong Bai, Qifei Li, Jinlong Xue, Yayue Deng, Zhengqi Wen, Ya Li |
| 2024 | CIKM | CAG: A Consistency-Adaptive Text-Image Alignment Generation for Joint Multimodal Entity-Relation Extraction. | Xinjie Yang, Xiaocheng Gong, Binghao Tang, Yang Lei, Yayue Deng, Huan Ouyang, Gang Zhao, Lei Luo, Yunling Feng, Bin Duan, Si Li, Yajing Xu |
| 2024 | ICASSP | Concss: Contrastive-based Context Comprehension for Dialogue-Appropriate Prosody in Conversational Speech Synthesis. | Yayue Deng, Jinlong Xue, Yukang Jia, Qifei Li, Yichen Han, Fengping Wang, Yingming Gao, Dengfeng Ke, Ya Li |
| 2024 | ICASSP | Frame-Level Emotional State Alignment Method for Speech Emotion Recognition. | Qifei Li, Yingming Gao, Cong Wang, Yayue Deng, Jinlong Xue, Yichen Han, Ya Li |
| 2024 | Interspeech | Retrieval Augmented Generation in Prompt-based Text-to-Speech Synthesis with Context-Aware Contrastive Language-Audio Pretraining. | Jinlong Xue, Yayue Deng, Yingming Gao, Ya Li |
| 2024 | Interspeech | Improving Audio Codec-based Zero-Shot Text-to-Speech Synthesis with Multi-Modal Context and Large Language Model. | Jinlong Xue, Yayue Deng, Yicheng Han, Yingming Gao, Ya Li |
| 2023 | ICASSP | M | Jinlong Xue, Yayue Deng, Fengping Wang, Ya Li, Yingming Gao, Jianhua Tao, Jianqing Sun, Jiaen Liang |
| 2020 | Interspeech | A Dynamic 3D Pronunciation Teaching Model Based on Pronunciation Attributes and Anatomy. | Xiaoli Feng, Yanlu Xie, Yayue Deng, Boxue Li |