| 2026 | ACL | VocalRep: Structure-Aware Vocal Representations for Multimodal Generation. | Da Shen, Zhenqiang Weng, Tianyu Liu, Gongyu Chen, Runhua Shi, Jiahui Chen, Chaofan Ding, Wei-Qiang Zhang, Zihao Chen |
| 2025 | ACL | GigaSpeech 2: An Evolving, Large-Scale and Multi-domain ASR Corpus for Low-Resource Languages with Automated Crawling, Transcription and Refinement. | Yifan Yang, Zheshu Song, Jianheng Zhuo, Mingyu Cui, Jinpeng Li, Bo Yang, Yexing Du, Ziyang Ma, Xunying Liu, Ziyuan Wang, Ke Li, Shuai Fan, Kai Yu, Wei-Qiang Zhang, Guoguo Chen, Xie Chen |
| 2025 | ICASSP | Improving Acoustic Scene Classification in Low-Resource Conditions. | Zhi Chen, Yun-Fei Shao, Yong Ma, Mingsheng Wei, Le Zhang, Wei-Qiang Zhang |
| 2025 | ICASSP | Data-Efficient Low-Complexity Acoustic Scene Classification via Distilling and Progressive Pruning. | Bing Han, Wen Huang, Zhengyang Chen, Anbai Jiang, Pingyi Fan, Cheng Lu, Zhiqiang Lv, Jia Liu, Wei-Qiang Zhang, Yanmin Qian |
| 2025 | ICASSP | Adaptive Prototype Learning for Anomalous Sound Detection with Partially Known Attributes. | Anbai Jiang, Xinhu Zheng, Bing Han, Yihong Qiu, Pingyi Fan, Wei-Qiang Zhang, Cheng Lu, Jia Liu |
| 2025 | ICASSP | WinStega: An Adaptive Robust Enhancement Framework for Generative Linguistic Steganography. | Kaiyi Pang, Minhao Bai, Jinshuai Yang, Wei-Qiang Zhang, Minghu Jiang, Yongfeng Huang |
| 2025 | ICASSP | Integrating Pause Information with Word Embeddings in Language Models for Alzheimer's Disease Detection from Spontaneous Speech. | Yu Pu, Wei-Qiang Zhang |
| 2025 | ICASSP | Metadata-Enhanced Speech Emotion Recognition: Augmented Residual Integration and Co-Attention in Two-Stage Fine-Tuning. | Zixiang Wan, Ziyue Qiu, Yiyang Liu, Wei-Qiang Zhang |
| 2025 | Interspeech | Whisper-Based Multilingual Alzheimer's Disease Detection and Improvements for Low-Resource Language. | Kaichen Jia, Jinpeng Li, Ke Li, Wei-Qiang Zhang |
| 2025 | Interspeech | DepressGEN: Synthetic Data Generation Framework for Depression Detection. | Wenrui Liang, Rong Zhang, Xuezhen Zhang, Ying Ma, Wei-Qiang Zhang |
| 2025 | Interspeech | Empowering Large Language Models for End-to-End Speech Translation Leveraging Synthetic Data. | Yu Pu, Xiaoqian Liu, Guangyu Zhang, Zheng Yan, Wei-Qiang Zhang, Xie Chen |
| 2025 | Interspeech | PPGs-BERT: Leveraging Phoneme Sequence and BERT for Alzheimer's Disease Detection from Spontaneous Speech. | Qi Sun, Ziyue Qiu, Yu Pu, Jinpeng Li, Xuchu Chen, Wei-Qiang Zhang |
| 2024 | GLOBECOM | CoopASD: Cooperative Machine Anomalous Sound Detection with Privacy Concerns. | Anbai Jiang, Yuchen Shi, Pingyi Fan, Wei-Qiang Zhang, Jia Liu |
| 2024 | ICASSP | Exploring Large Scale Pre-Trained Models for Robust Machine Anomalous Sound Detection. | Bing Han, Zhiqiang Lv, Anbai Jiang, Wen Huang, Zhengyang Chen, Yufeng Deng, Jiawei Ding, Cheng Lu, Wei-Qiang Zhang, Pingyi Fan, Jia Liu, Yanmin Qian |
| 2024 | ICASSP | Whisper-Based Transfer Learning for Alzheimer Disease Classification: Leveraging Speech Segments with Full Transcripts as Prompts. | Jinpeng Li, Wei-Qiang Zhang |
| 2024 | Interspeech | AnoPatch: Towards Better Consistency in Machine Anomalous Sound Detection. | Anbai Jiang, Bing Han, Zhiqiang Lv, Yufeng Deng, Wei-Qiang Zhang, Xie Chen, Yanmin Qian, Jia Liu, Pingyi Fan |
| 2024 | Interspeech | Improving Whisper's Recognition Performance for Under-Represented Language Kazakh Leveraging Unpaired Speech and Text. | Jinpeng Li, Yu Pu, Qi Sun, Wei-Qiang Zhang |
| 2024 | Interspeech | Simul-Whisper: Attention-Guided Streaming Whisper with Truncation Detection. | Haoyu Wang, Guoqiang Hu, Guodong Lin, Wei-Qiang Zhang, Jian Li |
| 2023 | ASRU | Transferring Speech-Generic and Depression-Specific Knowledge for Alzheimer's Disease Detection. | Ziyun Cui, Wen Wu, Wei-Qiang Zhang, Ji Wu, Chao Zhang |
| 2023 | ASRU | Exploring Effective Distillation of Self-Supervised Speech Models for Automatic Speech Recognition. | Yujin Wang, Changli Tang, Ziyang Ma, Zhisheng Zheng, Xie Chen, Wei-Qiang Zhang |
| 2023 | GLOBECOM | Decoupling Detectors for Scalable Anomaly Detection in AIoT Systems with Multiple Machines. | Qijun Hou, Anbai Jiang, Wei-Qiang Zhang, Pingyi Fan, Jia Liu |
| 2023 | ICASSP | Cross-Lingual Alzheimer's Disease Detection Based on Paralinguistic and Pre-Trained Features. | Xuchu Chen, Yu Pu, Jinpeng Li, Wei-Qiang Zhang |
| 2023 | ICASSP | Unsupervised Anomaly Detection and Localization of Machine Audio: A Gan-Based Approach. | Anbai Jiang, Wei-Qiang Zhang, Yufeng Deng, Pingyi Fan, Jia Liu |
| 2023 | Interspeech | DistilXLSR: A Light Weight Cross-Lingual Speech Representation Model. | Haoyu Wang, Siyuan Wang, Wei-Qiang Zhang, Jinfeng Bai |
| 2023 | Interspeech | Task-Agnostic Structured Pruning of Speech Representation Models. | Haoyu Wang, Siyuan Wang, Wei-Qiang Zhang, Hongbin Suo, Yulong Wan |
| 2022 | Interspeech | The THUEE System Description for the IARPA OpenASR21 Challenge. | Jing Zhao, Haoyu Wang, Jinpeng Li, Shuzhou Chai, Guanbo Wang, Guoguo Chen, Wei-Qiang Zhang |
| 2021 | ACL | DeepRapper: Neural Rap Generation with Rhyme and Rhythm Modeling. | Lanqing Xue, Kaitao Song, Duocai Wu, Xu Tan, Nevin L. Zhang, Tao Qin, Wei-Qiang Zhang, Tie-Yan Liu |
| 2021 | ASRU | Automatic Speech Recognition for Low-Resource Languages: The Thuee Systems for the IARPA Openasr20 Evaluation. | Jing Zhao, Gui-Xin Shi, Guan-Bo Wang, Wei-Qiang Zhang |
| 2021 | Interspeech | GigaSpeech: An Evolving, Multi-Domain ASR Corpus with 10, 000 Hours of Transcribed Audio. | Guoguo Chen, Shuzhou Chai, Guan-Bo Wang, Jiayu Du, Wei-Qiang Zhang, Chao Weng, Dan Su, Daniel Povey, Jan Trmal, Junbo Zhang, Mingjie Jin, Sanjeev Khudanpur, Shinji Watanabe, Shuaijiang Zhao, Wei Zou, Xiangang Li, Xuchen Yao, Yongqing Wang, Zhao You, Zhiyong Yan |
| 2021 | Interspeech | Adaptive Text to Speech for Spontaneous Style. | Yuzi Yan, Xu Tan, Bohan Li, Guangyan Zhang, Tao Qin, Sheng Zhao, Yuan Shen, Wei-Qiang Zhang, Tie-Yan Liu |
| 2021 | Interspeech | Language Recognition Based on Unsupervised Pretrained Models. | Haibin Yu, Jing Zhao, Song Yang, Zhongqin Wu, Yuting Nie, Wei-Qiang Zhang |
| 2020 | ICASSP | Staged Training Strategy and Multi-Activation for Audio Tagging with Noisy and Sparse Multi-Label Data. | Kexin He, Yuhan Shen, Wei-Qiang Zhang, Jia Liu |
| 2020 | ICASSP | Dynamic Temporal Residual Learning for Speech Recognition. | Jiaqi Xie, Ruijie Yan, Shanyu Xiao, Liangrui Peng, Michael T. Johnson, Wei-Qiang Zhang |
| 2019 | Interspeech | Hierarchical Pooling Structure for Weakly Labeled Sound Event Detection. | Ke-Xin He, Yu-Han Shen, Wei-Qiang Zhang |
| 2019 | Interspeech | Towards Discriminative Representations and Unbiased Predictions: Class-Specific Angular Softmax for Speech Emotion Recognition. | Zhixuan Li, Liang He, Jingyang Li, Li Wang, Wei-Qiang Zhang |
| 2019 | Interspeech | Learning How to Listen: A Temporal-Frequential Attention Model for Sound Event Detection. | Yu-Han Shen, Ke-Xin He, Wei-Qiang Zhang |
| 2019 | Interspeech | Music Genre Classification Using Duplicated Convolutional Layers in Neural Networks. | Hansi Yang, Wei-Qiang Zhang |
| 2017 | ASRU | Gated convolutional networks based hybrid acoustic models for low resource speech recognition. | Jian Kang, Wei-Qiang Zhang, Jia Liu |
| 2017 | ICASSP | An LSTM-CTC based verification system for proxy-word based OOV keyword search. | Zhiqiang Lv, Jian Kang, Wei-Qiang Zhang, Jia Liu |
| 2017 | ICASSP | Deep neural networks based speaker modeling at different levels of phonetic granularity. | Yao Tian, Liang He, Meng Cai, Wei-Qiang Zhang, Jia Liu |
| 2016 | Interspeech | A Novel Discriminative Score Calibration Method for Keyword Search. | Zhiqiang Lv, Meng Cai, Wei-Qiang Zhang, Jia Liu |
| 2016 | Interspeech | Improving Deep Neural Networks Based Speaker Verification Using Unlabeled Data. | Yao Tian, Meng Cai, Liang He, Wei-Qiang Zhang, Jia Liu |
| 2015 | ASRU | Improved system fusion for keyword search. | Zhiqiang Lv, Meng Cai, Cheng Lu, Jian Kang, Like Hui, Wei-Qiang Zhang, Jia Liu |
| 2015 | ICASSP | The THUEE system for the openKWS14 keyword search evaluation. | Meng Cai, Zhiqiang Lv, Beili Song, Yongzhe Shi, Wei-lan Wu, Cheng Lu, Wei-Qiang Zhang, Jia Liu |
| 2015 | ICASSP | Neuron sparseness versus connection sparseness in deep neural network for large vocabulary speech recognition. | Jian Kang, Cheng Lu, Meng Cai, Wei-Qiang Zhang, Jia Liu |
| 2014 | ICASSP | Improved phonotactic language recognition based on RNN feature reconstruction. | Wei-Wei Liu, Wei-Qiang Zhang, Yongzhe Shi, An Ji, Jiaming Xu, Jia Liu |
| 2014 | ICASSP | Variance regularization of RNNLM for speech recognition. | Yongzhe Shi, Wei-Qiang Zhang, Meng Cai, Jia Liu |
| 2014 | Interspeech | Phonotactic language recognition based on time-gap-weighted lattice kernels. | Wei-Wei Liu, Wei-Qiang Zhang, Jia Liu |
| 2014 | Interspeech | Speaker adaptation based on sparse and low-rank eigenphone matrix estimation. | Wen-Lin Zhang, Dan Qu, Wei-Qiang Zhang, Bi-Cheng Li |
| 2013 | ASRU | Compact acoustic modeling based on acoustic manifold using a mixture of factor analyzers. | Wen-Lin Zhang, Bi-Cheng Li, Wei-Qiang Zhang |
| 2013 | Interspeech | Parallel absolute-relative feature based phonotactic language recognition. | Weiwei Liu, Wei-Qiang Zhang, Zhiyi Li, Jia Liu |
| 2013 | Interspeech | THU-EE system fusion for the NIST 2012 speaker recognition evaluation. | Wei-Qiang Zhang, Zhiyi Li, Weiwei Liu, Jia Liu |
| 2012 | CIS | Image Denoising Based on Wave Atoms and Cycle Spinning. | Wei-Qiang Zhang, Yi-Mei Song, Jiqiang Feng |
| 2011 | ASRU | Speaker adaptation based on speaker-dependent eigenphone estimation. | Wen-Lin Zhang, Wei-Qiang Zhang, Bi-Cheng Li |
| 2007 | ICASSP | Two-Stage Method for Specific Audio Retrieval. | Wei-Qiang Zhang, Jia Liu |