| 2026 | AAAI | SpeakerLM: End-to-End Versatile Speaker Diarization and Recognition with Multimodal Large Language Models. | Han Yin, Yafeng Chen, Chong Deng, Luyao Cheng, Hui Wang, Chao-Hong Tan, Qian Chen, Wen Wang, Xiangang Li |
| 2026 | ACL | UniVocal: Unified Speech-Singing Code-Switching Synthesis. | Yufei Shi, Qian Chen, Wen Wang, Xiangang Li, Zhen-Hua Ling, Yang Ai |
| 2026 | ACL | GenesisFunc: Multi-Agent Data Generation for Accurate and Generalizable Function-Calling. | Hao-Xiang Xu, Chong Deng, Jiaqing Liu, Wen Wang, Qian Chen, Lujia Bao, Xiangang Li, Zhen-Hua Ling |
| 2025 | ACL | Memorizing is Not Enough: Deep Knowledge Injection Through Reasoning. | Ruoxi Xu, Yunjie Ji, Boxi Cao, Yaojie Lu, Hongyu Lin, Xianpei Han, Ben He, Yingfei Sun, Xiangang Li, Le Sun |
| 2024 | ICLR | OpenChat: Advancing Open-source Language Models with Mixed-Quality Data. | Guan Wang, Sijie Cheng, Xianyuan Zhan, Xiangang Li, Sen Song, Yang Liu |
| 2023 | AAAI | Domain-Adapted Dependency Parsing for Cross-Domain Named Entity Recognition. | Chenxiao Dou, Xianghui Sun, Yaoshu Wang, Yunjie Ji, Baochang Ma, Xiangang Li |
| 2023 | CVPR | Semi-Supervised 2D Human Pose Estimation Driven by Position Inconsistency Pseudo Label Correction Module. | Linzhi Huang, Yulong Li, Hongbo Tian, Yue Yang, Xiangang Li, Weihong Deng, Jieping Ye |
| 2022 | ICASSP | Time Domain Adversarial Voice Conversion for ADD 2022. | Cheng Wen, Tingwei Guo, Xingjun Tan, Rui Yan, Shuran Zhou, Chuandong Xie, Wei Zou, Xiangang Li |
| 2022 | ICASSP | Audio-Visual Wake Word Spotting System for MISP Challenge 2021. | Yanguang Xu, Jianwei Sun, Yang Han, Shuaijiang Zhao, Chaoyang Mei, Tingwei Guo, Shuran Zhou, Chuandong Xie, Wei Zou, Xiangang Li |
| 2022 | ICASSP | Audio Deepfake Detection System with Neural Stitching for ADD 2022. | Rui Yan, Cheng Wen, Shuran Zhou, Tingwei Guo, Wei Zou, Xiangang Li |
| 2022 | NAACL | To Answer or Not To Answer? Improving Machine Reading Comprehension Model with Span-based Contrastive Learning. | Yunjie Ji, Liangyu Chen, Chenxiao Dou, Baochang Ma, Xiangang Li |
| 2021 | ICASSP | Didispeech: A Large Scale Mandarin Speech Corpus. | Tingwei Guo, Cheng Wen, Dongwei Jiang, Ne Luo, Ruixiong Zhang, Shuaijiang Zhao, Wubo Li, Cheng Gong, Wei Zou, Kun Han, Xiangang Li |
| 2021 | ICASSP | A Further Study of Unsupervised Pretraining for Transformer Based Speech Recognition. | Dongwei Jiang, Wubo Li, Ruixiong Zhang, Miao Cao, Ne Luo, Yang Han, Wei Zou, Kun Han, Xiangang Li |
| 2021 | ICASSP | Transformer Based Unsupervised Pre-Training for Acoustic Representation Learning. | Ruixiong Zhang, Haiwei Wu, Wubo Li, Dongwei Jiang, Wei Zou, Xiangang Li |
| 2021 | Interspeech | GigaSpeech: An Evolving, Multi-Domain ASR Corpus with 10, 000 Hours of Transcribed Audio. | Guoguo Chen, Shuzhou Chai, Guan-Bo Wang, Jiayu Du, Wei-Qiang Zhang, Chao Weng, Dan Su, Daniel Povey, Jan Trmal, Junbo Zhang, Mingjie Jin, Sanjeev Khudanpur, Shinji Watanabe, Shuaijiang Zhao, Wei Zou, Xiangang Li, Xuchen Yao, Yongqing Wang, Zhao You, Zhiyong Yan |
| 2021 | Interspeech | Speech SimCLR: Combining Contrastive and Reconstruction Objective for Self-Supervised Speech Representation Learning. | Dongwei Jiang, Wubo Li, Miao Cao, Wei Zou, Xiangang Li |
| 2021 | Interspeech | Semantic Data Augmentation for End-to-End Mandarin Speech Recognition. | Jianwei Sun, Zhiyuan Tang, Hengxin Yin, Wei Wang, Xi Zhao, Shuaijiang Zhao, Xiaoning Lei, Wei Zou, Xiangang Li |
| 2020 | ICASSP | DNN-based Mask Estimation Integrating Spectral and Spatial Features for Robust Beamforming. | Chengyun Deng, Hui Song, Yi Zhang, Yongtao Sha, Xiangang Li |
| 2020 | ICASSP | Selective Attention Encoders by Syntactic Graph Convolutional Networks for Document Summarization. | Haiyang Xu, Yun Wang, Kun Han, Baochang Ma, Junwen Chen, Xiangang Li |
| 2020 | Interspeech | Conv-TasSAN: Separative Adversarial Network Based on Conv-TasNet. | Chengyun Deng, Yi Zhang, Shiqian Ma, Yongtao Sha, Hui Song, Xiangang Li |
| 2020 | Interspeech | TMT: A Transformer-Based Modal Translator for Improving Multimodal Sequence Representations in Audio Visual Scene-Aware Dialog. | Wubo Li, Dongwei Jiang, Wei Zou, Xiangang Li |
| 2020 | Interspeech | Generative Adversarial Network Based Acoustic Echo Cancellation. | Yi Zhang, Chengyun Deng, Shiqian Ma, Yongtao Sha, Hui Song, Xiangang Li |
| 2020 | Interspeech | On Loss Functions and Recurrency Training for GAN-Based Speech Enhancement Systems. | Zhuohuang Zhang, Chengyun Deng, Yi Shen, Donald S. Williamson, Yongtao Sha, Yi Zhang, Hui Song, Xiangang Li |
| 2019 | ICASSP | Replay Attack Detection Using Magnitude and Phase Information with Attention-based Adaptive Filters. | Meng Liu, Longbiao Wang, Jianwu Dang, Seiichi Nakagawa, Haotian Guan, Xiangang Li |
| 2019 | ICDM | NVSRN: A Neural Variational Scaling Reasoning Network for Initiative Response Generation. | Jinxin Chang, Ruifang He, Haiyang Xu, Kun Han, Longbiao Wang, Xiangang Li, Jianwu Dang |
| 2019 | IJCNN | Learning Syntactic and Dynamic Selective Encoding for Document Summarization. | Haiyang Xu, Yahao He, Kun Han, Junwen Chen, Xiangang Li |
| 2019 | Interspeech | Environment-Dependent Attention-Driven Recurrent Convolutional Neural Network for Robust Speech Enhancement. | Meng Ge, Longbiao Wang, Nan Li, Hao Shi, Jianwu Dang, Xiangang Li |
| 2019 | Interspeech | Learning Alignment for Multimodal Emotion Recognition from Speech. | Haiyang Xu, Hui Zhang, Kun Han, Yun Wang, Yiping Peng, Xiangang Li |
| 2018 | COLING | Implicit Discourse Relation Recognition using Neural Tensor Network with Interactive Attention and Sparse Learning. | Fengyu Guo, Ruifang He, Di Jin, Jianwu Dang, Longbiao Wang, Xiangang Li |
| 2018 | COLING | Interaction-Aware Topic Model for Microblog Conversations through Network Embedding and User Attention. | Ruifang He, Xuefei Zhang, Di Jin, Longbiao Wang, Jianwu Dang, Xiangang Li |
| 2018 | Interspeech | Speech Emotion Recognition by Combining Amplitude and Phase Information Using Convolutional Neural Network. | Lili Guo, Longbiao Wang, Jianwu Dang, Linjuan Zhang, Haotian Guan, Xiangang Li |
| 2018 | Interspeech | Multiple Phase Information Combination for Replay Attacks Detection. | Dongbo Li, Longbiao Wang, Jianwu Dang, Meng Liu, Zeyan Oo, Seiichi Nakagawa, Haotian Guan, Xiangang Li |
| 2017 | ICML | Gram-CTC: Automatic Unit Selection and Target Decomposition for Sequence Labelling. | Hairong Liu, Zhenyao Zhu, Xiangang Li, Sanjeev Satheesh |
| 2016 | ICML | Deep Speech 2 : End-to-End Speech Recognition in English and Mandarin. | Dario Amodei, Sundaram Ananthanarayanan, Rishita Anubhai, Jingliang Bai, Eric Battenberg, Carl Case, Jared Casper, Bryan Catanzaro, Jingdong Chen, Mike Chrzanowski, Adam Coates, Greg Diamos, Erich Elsen, Jesse H. Engel, Linxi Fan, Christopher Fougner, Awni Y. Hannun, Billy Jun, Tony Han, Patrick LeGresley, Xiangang Li, Libby Lin, Sharan Narang, Andrew Y. Ng, Sherjil Ozair, Ryan Prenger, Sheng Qian, Jonathan Raiman, Sanjeev Satheesh, David Seetapun, Shubho Sengupta, Chong Wang, Yi Wang, Zhiqian Wang, Bo Xiao, Yan Xie, Dani Yogatama, Jun Zhan, Zhenyao Zhu |
| 2015 | ICASSP | Constructing long short-term memory based deep recurrent neural networks for large vocabulary speech recognition. | Xiangang Li, Xihong Wu |
| 2015 | ICASSP | Improving long short-term memory networks using maxout units for large vocabulary speech recognition. | Xiangang Li, Xihong Wu |
| 2015 | Interspeech | Modeling speaker variability using long short-term memory networks for speech recognition. | Xiangang Li, Xihong Wu |
| 2015 | Interspeech | Long short-term memory based convolutional recurrent neural networks for large vocabulary speech recognition. | Xiangang Li, Xihong Wu |
| 2015 | Interspeech | I-vector dependent feature space transformations for adaptive speech recognition. | Xiangang Li, Xihong Wu |
| 2014 | ICASSP | Query-based composition for large-scale language model in LVCSR. | Yang Han, Chenwei Zhang, Xiangang Li, Yi Liu, Xihong Wu |
| 2012 | Interspeech | Probabilistic Speaker-Class based Acoustic Modeling for Large Vocabulary Continuous Speech Recognition. | Xiangang Li, Dan Su, Zaihu Pang, Xihong Wu |