| 2025 | AAAI | CSSinger: End-to-End Chunkwise Streaming Singing Voice Synthesis System Based on Conditional Variational Autoencoder. | Jianwei Cui, Yu Gu, Shihao Chen, Jie Zhang, Liping Chen, Lirong Dai |
| 2025 | ICASSP | Leveraging Boolean Directivity Embedding for Binaural Target Speaker Extraction. | Yichi Wang, Jie Zhang, Chengqian Jiang, Weitai Zhang, Zhongyi Ye, Lirong Dai |
| 2025 | ICASSP | Bridging Modality Gap with Large Speech and Language Models for End-to-End Speech-to-Text Translation. | Weitai Zhang, Simran Naagar, Zhongyi Ye, Peiwang Tang, Xinyuan Zhou, Junhua Liu, Lirong Dai |
| 2025 | Interspeech | An Effective Anomalous Sound Detection Method Based on Global and Local Attribute Mining. | Nan Jiang, Yan Song, Qing Gu, Haoyu Song, Lirong Dai, Ian McLoughlin |
| 2025 | Interspeech | Finetune Large Pre-Trained Model Based on Frequency-Wise Multi-Query Attention Pooling for Anomalous Sound Detection. | Nan Jiang, Yan Song, Qing Gu, Haoyu Song, Lirong Dai, Ian McLoughlin |
| 2025 | Interspeech | A Domain Robust Pre-Training Method with Local Prototypes for Speaker Verification. | Qing Gu, Yan Song, Haoyu Song, Nan Jiang, Lirong Dai, Ian McLoughlin |
| 2024 | AAAI | Multichannel AV-wav2vec2: A Framework for Learning Multichannel Multi-Modal Speech Representation. | Qiushi Zhu, Jie Zhang, Yu Gu, Yuchen Hu, Lirong Dai |
| 2024 | ICASSP | Adversarial Speech for Voice Privacy Protection from Personalized Speech Generation. | Shihao Chen, Liping Chen, Jie Zhang, Kong-Aik Lee, Zhenhua Ling, Lirong Dai |
| 2024 | ICASSP | Sifisinger: A High-Fidelity End-to-End Singing Voice Synthesizer Based on Source-Filter Model. | Jianwei Cui, Yu Gu, Chao Weng, Jie Zhang, Liping Chen, Lirong Dai |
| 2024 | ICASSP | A Study of Multichannel Spatiotemporal Features and Knowledge Distillation on Robust Target Speaker Extraction. | Yichi Wang, Jie Zhang, Shihao Chen, Weitai Zhang, Zhongyi Ye, Xinyuan Zhou, Lirong Dai |
| 2024 | ICASSP | Pre-Trained Acoustic-and-Textual Modeling for End-To-End Speech-To-Text Translation. | Weitai Zhang, Hanyi Zhang, Chenxuan Liu, Zhongyi Ye, Xinyuan Zhou, Chao Lin, Lirong Dai |
| 2024 | Interspeech | LDM-SVC: Latent Diffusion Model Based Zero-Shot Any-to-Any Singing Voice Conversion with Singer Guidance. | Shihao Chen, Yu Gu, Jie Zhang, Na Li, Rilin Chen, Liping Chen, Lirong Dai |
| 2024 | Interspeech | An Effective Local Prototypical Mapping Network for Speech Emotion Recognition. | Yuxuan Xi, Yan Song, Lirong Dai, Haoyu Song, Ian McLoughlin |
| 2023 | ICCV | Speech4Mesh: Speech-Assisted Monocular 3D Facial Reconstruction for Speech-Driven 3D Facial Animation. | Shan He, Haonan He, Shuo Yang, Xiaoyan Wu, Pengcheng Xia, Bing Yin, Cong Liu, Lirong Dai, Chang Xu |
| 2022 | EMNLP | SpeechUT: Bridging Speech and Text with Hidden-Unit for Encoder-Decoder Based Speech-Text Pre-training. | Ziqiang Zhang, Long Zhou, Junyi Ao, Shujie Liu, Lirong Dai, Jinyu Li, Furu Wei |
| 2022 | ICIP | Learning Contextually Fused Audio-Visual Representations For Audio-Visual Speech Recognition. | Ziqiang Zhang, Jie Zhang, Jianshu Zhang, Ming-Hui Wu, Xin Fang, Lirong Dai |
| 2022 | ICPR | Structural String Decoder for Handwritten Mathematical Expression Recognition. | Jiajia Wu, Jinshui Hu, Mingjun Chen, Lirong Dai, Xuejing Niu, Ning Wang |
| 2022 | Interspeech | Pre-Training Transformer Decoder for End-to-End ASR Model with Unpaired Speech Data. | Junyi Ao, Ziqiang Zhang, Long Zhou, Shujie Liu, Haizhou Li, Tom Ko, Lirong Dai, Jinyu Li, Yao Qian, Furu Wei |
| 2022 | Interspeech | A Complementary Joint Training Approach Using Unpaired Speech and Text A Complementary Joint Training Approach Using Unpaired Speech and Text. | Ye-Qian Du, Jie Zhang, Qiu-Shi Zhu, Lirong Dai, Ming-Hui Wu, Xin Fang, Zhou-Wang Yang |
| 2022 | Interspeech | External Text Based Data Augmentation for Low-Resource Speech Recognition in the Constrained Condition of OpenASR21 Challenge. | Guolong Zhong, Hongyu Song, Ruoyu Wang, Lei Sun, Diyuan Liu, Jia Pan, Xin Fang, Jun Du, Jie Zhang, Lirong Dai |
| 2021 | AAAI | TaLNet: Voice Reconstruction from Tongue and Lip Articulation with Transfer Learning from Text-to-Speech Synthesis. | Jing-Xuan Zhang, Korin Richmond, Zhen-Hua Ling, Lirong Dai |
| 2020 | ICASSP | Attention-Based Gated Scaling Adaptive Acoustic Model for CTC-Based Speech Recognition. | Fenglin Ding, Wu Guo, Lirong Dai, Jun Du |
| 2020 | ICASSP | An Improved Deep Neural Network for Modeling Speaker Characteristics at Different Temporal Scales. | Bin Gu, Wu Guo, Lirong Dai, Jun Du |
| 2020 | ICML | A Tree-Structured Decoder for Image-to-Markup Generation. | Jianshu Zhang, Jun Du, Yongxin Yang, Yi-Zhe Song, Si Wei, Lirong Dai |
| 2018 | ICASSP | Pseudo-Supervised Approach for Text Clustering Based on Consensus Analysis. | Peixin Chen, Wu Guo, Lirong Dai, Zhenhua Ling |
| 2018 | ICASSP | Deep-FSMN for Large Vocabulary Continuous Speech Recognition. | Shiliang Zhang, Ming Lei, Zhijie Yan, Lirong Dai |
| 2018 | ICPR | Multi-Scale Attention with Dense Encoder for Handwritten Mathematical Expression Recognition. | Jianshu Zhang, Jun Du, Lirong Dai |
| 2018 | ICPR | Trajectory-based Radical Analysis Network for Online Handwritten Chinese Character Recognition. | Jianshu Zhang, Yixing Zhu, Jun Du, Lirong Dai |
| 2018 | Interspeech | An Improved Deep Embedding Learning Method for Short Duration Speaker Verification. | Zhifu Gao, Yan Song, Ian McLoughlin, Wu Guo, Lirong Dai |
| 2018 | Interspeech | An Attention Pooling Based Representation Learning Method for Speech Emotion Recognition. | Pengcheng Li, Yan Song, Ian McLoughlin, Wu Guo, Lirong Dai |
| 2018 | Interspeech | Acoustic Modeling with Densely Connected Residual Network for Multichannel Speech Recognition. | Jian Tang, Yan Song, Lirong Dai, Ian McLoughlin |
| 2017 | ICDAR | A GRU-Based Encoder-Decoder Approach with Attention for Online Handwritten Mathematical Expression Recognition. | Jianshu Zhang, Jun Du, Lirong Dai |
| 2012 | HPCC | Using Risk in Access Control for Cloud-Assisted eHealth. | Meeta Sharma, Yan Bai, Sam Chung, Lirong Dai |
| 2005 | SEKE | Modeling Reusable Security Aspects for Software Architectures: a Pattern Driven Approach. | Kendra M. L. Cooper, Lirong Dai, W. Eric Wong |
| 2005 | SNPD | Modeling and Analysis of Non-Functional Requirements as Aspects in a UML Based Architecture Design. | Lirong Dai, Kendra M. L. Cooper |