| 2024 | AAAI | Multichannel AV-wav2vec2: A Framework for Learning Multichannel Multi-Modal Speech Representation. | Qiushi Zhu, Jie Zhang, Yu Gu, Yuchen Hu, Lirong Dai |
| 2024 | ACL | Listen Again and Choose the Right Answer: A New Paradigm for Automatic Speech Recognition with Large Language Models. | Yuchen Hu, Chen Chen, Chengwei Qin, Qiushi Zhu, Engsiong Chng, Ruizhe Li |
| 2024 | ICASSP | DurIAN-E 2: Duration Informed Attention Network with Adaptive Variational Autoencoder and Adversarial Learning for Expressive Text-to-Speech Synthesis. | Yu Gu, Qiushi Zhu, Guangzhi Lei, Chao Weng, Dan Su |
| 2024 | ICASSP | An Experimental Comparison of Noise-Robust Text-To-Speech Synthesis Systems Based On Self-Supervised Representation. | Xiao-Ying Zhao, Qiushi Zhu, Yuchen Hu |
| 2024 | Interspeech | Noise-aware Speech Enhancement using Diffusion Probabilistic Model. | Yuchen Hu, Chen Chen, Ruizhe Li, Qiushi Zhu, Eng Siong Chng |
| 2023 | ICASSP | Gradient Remedy for Multi-Task Learning in End-to-End Noise-Robust Speech Recognition. | Yuchen Hu, Chen Chen, Ruizhe Li, Qiushi Zhu, Eng Siong Chng |
| 2023 | IJCAI | Cross-Modal Global Interaction and Local Alignment for Audio-Visual Speech Recognition. | Yuchen Hu, Ruizhe Li, Chen Chen, Heqing Zou, Qiushi Zhu, Eng Siong Chng |