| 2025 | ACL | GigaSpeech 2: An Evolving, Large-Scale and Multi-domain ASR Corpus for Low-Resource Languages with Automated Crawling, Transcription and Refinement. | Yifan Yang, Zheshu Song, Jianheng Zhuo, Mingyu Cui, Jinpeng Li, Bo Yang, Yexing Du, Ziyang Ma, Xunying Liu, Ziyuan Wang, Ke Li, Shuai Fan, Kai Yu, Wei-Qiang Zhang, Guoguo Chen, Xie Chen |
| 2025 | ICASSP | Disentangling Speakers in Multi-Talker Speech Recognition with Speaker-Aware CTC. | Jiawen Kang, Lingwei Meng, Mingyu Cui, Yuejiao Wang, Xixin Wu, Xunying Liu, Helen Meng |
| 2025 | ICASSP | Large Language Model Can Transcribe Speech in Multi-Talker Scenarios with Versatile Instructions. | Lingwei Meng, Shujie Hu, Jiawen Kang, Zhaoqing Li, Yuejiao Wang, Wenxuan Wu, Xixin Wu, Xunying Liu, Helen Meng |
| 2025 | ICASSP | Phone-purity Guided Discrete Tokens for Dysarthric Speech Recognition. | Huimeng Wang, Xurong Xie, Mengzhe Geng, Shujie Hu, Haoning Xu, Youjun Chen, Zhaoqing Li, Jiajun Deng, Xunying Liu |
| 2025 | ICASSP | Effective and Efficient Mixed Precision Quantization of Speech Foundation Models. | Haoning Xu, Zhaoqing Li, Zengrui Jin, Huimeng Wang, Youjun Chen, Guinan Li, Mengzhe Geng, Shujie Hu, Jiajun Deng, Xunying Liu |
| 2025 | Interspeech | Towards LLM-Empowered Fine-Grained Speech Descriptors for Explainable Emotion Recognition. | Youjun Chen, Xurong Xie, Haoning Xu, Mengzhe Geng, Guinan Li, Chengxi Deng, Huimeng Wang, Shujie Hu, Xunying Liu |
| 2025 | Interspeech | Exploring SSL Discrete Speech Features for Zipformer-based Contextual ASR. | Mingyu Cui, Yifan Yang, Jiajun Deng, Jiawen Kang, Shujie Hu, Tianzi Wang, Zhaoqing Li, Shiliang Zhang, Xie Chen, Xunying Liu |
| 2025 | Interspeech | MOPSA: Mixture of Prompt-Experts Based Speaker Adaptation for Elderly Speech Recognition. | Chengxi Deng, Xurong Xie, Shujie Hu, Mengzhe Geng, Yicong Jiang, Jiankun Zhao, Jiajun Deng, Guinan Li, Youjun Chen, Huimeng Wang, Haoning Xu, Mingyu Cui, Xunying Liu |
| 2025 | Interspeech | On-the-fly Routing for Zero-shot MoE Speaker Adaptation of Speech Foundation Models for Dysarthric Speech Recognition. | Shujie Hu, Xurong Xie, Mengzhe Geng, Jiajun Deng, Huimeng Wang, Guinan Li, Chengxi Deng, Tianzi Wang, Mingyu Cui, Helen Meng, Xunying Liu |
| 2025 | Interspeech | Towards One-bit ASR: Extremely Low-bit Conformer Quantization Using Co-training and Stochastic Precision. | Zhaoqing Li, Haoning Xu, Zengrui Jin, Lingwei Meng, Tianzi Wang, Huimeng Wang, Youjun Chen, Mingyu Cui, Shujie Hu, Xunying Liu |
| 2025 | Interspeech | Unfolding A Few Structures for The Many: Memory-Efficient Compression of Conformer and Speech Foundation Models. | Zhaoqing Li, Haoning Xu, Xurong Xie, Zengrui Jin, Tianzi Wang, Xunying Liu |
| 2025 | Interspeech | Effective and Efficient One-pass Compression of Speech Foundation Models Using Sparsity-aware Self-pinching Gates. | Haoning Xu, Zhaoqing Li, Youjun Chen, Huimeng Wang, Guinan Li, Mengzhe Geng, Chengxi Deng, Xunying Liu |
| 2025 | Interspeech | Regularized Federated Learning for Privacy-Preserving Dysarthric and Elderly Speech Recognition. | Tao Zhong, Mengzhe Geng, Shujie Hu, Guinan Li, Xunying Liu |
| 2024 | EMNLP | WavLLM: Towards Robust and Adaptive Speech Large Language Model. | Shujie Hu, Long Zhou, Shujie Liu, Sanyuan Chen, Lingwei Meng, Hongkun Hao, Jing Pan, Xunying Liu, Jinyu Li, Sunit Sivasankaran, Linquan Liu, Furu Wei |
| 2024 | ICASSP | Cross-Speaker Encoding Network for Multi-Talker Speech Recognition. | Jiawen Kang, Lingwei Meng, Mingyu Cui, Haohan Guo, Xixin Wu, Xunying Liu, Helen Meng |
| 2024 | ICASSP | Exploiting Audio-Visual Features with Pretrained AV-HuBERT for Multi-Modal Dysarthric Speech Reconstruction. | Xueyuan Chen, Yuejiao Wang, Xixin Wu, Disong Wang, Zhiyong Wu, Xunying Liu, Helen Meng |
| 2024 | ICASSP | Towards High-Performance and Low-Latency Feature-Based Speaker Adaptation of Conformer Speech Recognition Systems. | Jiajun Deng, Xurong Xie, Guinan Li, Mingyu Cui, Mengzhe Geng, Zengrui Jin, Tianzi Wang, Shujie Hu, Zhaoqing Li, Xunying Liu |
| 2024 | ICASSP | Towards Automatic Data Augmentation for Disordered Speech Recognition. | Zengrui Jin, Xurong Xie, Tianzi Wang, Mengzhe Geng, Jiajun Deng, Guinan Li, Shujie Hu, Xunying Liu |
| 2024 | ICASSP | Enhancing Pre-Trained ASR System Fine-Tuning for Dysarthric Speech Recognition Using Adversarial Data Augmentation. | Huimeng Wang, Zengrui Jin, Mengzhe Geng, Shujie Hu, Guinan Li, Tianzi Wang, Haoning Xu, Xunying Liu |
| 2024 | Interspeech | Perceiver-Prompt: Flexible Speaker Adaptation in Whisper for Chinese Disordered Speech Recognition. | Yicong Jiang, Tianzi Wang, Xurong Xie, Juan Liu, Wei Sun, Nan Yan, Hui Chen, Lan Wang, Xunying Liu, Feng Tian |
| 2024 | Interspeech | Joint Speaker Features Learning for Audio-visual Multichannel Speech Separation and Recognition. | Guinan Li, Jiajun Deng, Youjun Chen, Mengzhe Geng, Shujie Hu, Zhe Li, Zengrui Jin, Tianzi Wang, Xurong Xie, Helen Meng, Xunying Liu |
| 2024 | Interspeech | One-pass Multiple Conformer and Foundation Speech Systems Compression and Quantization Using An All-in-one Neural Model. | Zhaoqing Li, Haoning Xu, Tianzi Wang, Shoukang Hu, Zengrui Jin, Shujie Hu, Jiajun Deng, Mingyu Cui, Mengzhe Geng, Xunying Liu |
| 2024 | Interspeech | Empowering Whisper as a Joint Multi-Talker and Target-Talker Speech Recognition System. | Lingwei Meng, Jiawen Kang, Yuejiao Wang, Zengrui Jin, Xixin Wu, Xunying Liu, Helen Meng |
| 2024 | Interspeech | Towards Effective and Efficient Non-autoregressive Decoding Using Block-based Attention Mask. | Tianzi Wang, Xurong Xie, Zhaoqing Li, Shoukang Hu, Zengrui Jin, Jiajun Deng, Mingyu Cui, Shujie Hu, Mengzhe Geng, Guinan Li, Helen Meng, Xunying Liu |
| 2023 | ICASSP | Exploring Self-Supervised Pre-Trained ASR Models for Dysarthric and Elderly Speech Recognition. | Shujie Hu, Xurong Xie, Zengrui Jin, Mengzhe Geng, Yi Wang, Mingyu Cui, Jiajun Deng, Xunying Liu, Helen Meng |
| 2023 | ICASSP | Adversarial Data Augmentation Using VAE-GAN for Disordered Speech Recognition. | Zengrui Jin, Xurong Xie, Mengzhe Geng, Tianzi Wang, Shujie Hu, Jiajun Deng, Guinan Li, Xunying Liu |
| 2023 | ICASSP | Leveraging Pretrained Representations With Task-Related Keywords for Alzheimer's Disease Detection. | Jinchao Li, Kaitao Song, Junan Li, Bo Zheng, Dongsheng Li, Xixin Wu, Xunying Liu, Helen Meng |
| 2023 | ICASSP | A Hierarchical Regression Chain Framework for Affective Vocal Burst Recognition. | Jinchao Li, Xixin Wu, Kaitao Song, Dongsheng Li, Xunying Liu, Helen Meng |
| 2023 | ICASSP | Exploiting Prompt Learning with Pre-Trained Language Models for Alzheimer's Disease Detection. | Yi Wang, Jiajun Deng, Tianzi Wang, Bo Zheng, Shoukang Hu, Xunying Liu, Helen Meng |
| 2023 | ICASSP | Unsupervised Model-Based Speaker Adaptation of End-To-End Lattice-Free MMI Model for Speech Recognition. | Xurong Xie, Xunying Liu, Hui Chen, Hongan Wang |
| 2023 | Interspeech | Towards Effective and Compact Contextual Representation for Conformer Transducer Speech Recognition Systems. | Mingyu Cui, Jiawen Kang, Jiajun Deng, Xi Yin, Yutao Xie, Xie Chen, Xunying Liu |
| 2023 | Interspeech | Factorised Speaker-environment Adaptive Training of Conformer Speech Recognition Systems. | Jiajun Deng, Guinan Li, Xurong Xie, Zengrui Jin, Mingyu Cui, Tianzi Wang, Shujie Hu, Mengzhe Geng, Xunying Liu |
| 2023 | Interspeech | Use of Speech Impairment Severity for Dysarthric Speech Recognition. | Mengzhe Geng, Zengrui Jin, Tianzi Wang, Shujie Hu, Jiajun Deng, Mingyu Cui, Guinan Li, Jianwei Yu, Xurong Xie, Xunying Liu |
| 2023 | Interspeech | On-the-Fly Feature Based Rapid Speaker Adaptation for Dysarthric and Elderly Speech Recognition. | Mengzhe Geng, Xurong Xie, Rongfeng Su, Jianwei Yu, Zengrui Jin, Tianzi Wang, Shujie Hu, Zi Ye, Helen Meng, Xunying Liu |
| 2023 | Interspeech | Exploiting Cross-Domain And Cross-Lingual Ultrasound Tongue Imaging Features For Elderly And Dysarthric Speech Recognition. | Shujie Hu, Xurong Xie, Mengzhe Geng, Mingyu Cui, Jiajun Deng, Guinan Li, Tianzi Wang, Helen Meng, Xunying Liu |
| 2023 | Interspeech | Lossless 4-bit Quantization of Architecture Compressed Conformer ASR Systems on the 300-hr Switchboard Corpus. | Zhaoqing Li, Tianzi Wang, Jiajun Deng, Junhao Xu, Shoukang Hu, Xunying Liu |
| 2023 | Interspeech | Integrated and Enhanced Pipeline System to Support Spoken Language Analytics for Screening Neurocognitive Disorders. | Helen Meng, Brian Mak, Man-Wai Mak, Helene H. Fung, Xianmin Gong, Timothy C. Y. Kwok, Xunying Liu, Vincent C. T. Mok, Patrick C. M. Wong, Jean Woo, Xixin Wu, Ka Ho Wong, Sean Shensheng Xu, Naijun Zheng, Ranzo Huang, Jiawen Kang, Xiaoquan Ke, Junan Li, Jinchao Li, Yi Wang |
| 2023 | Interspeech | Hyper-parameter Adaptation of Conformer ASR Systems for Elderly and Dysarthric Speech Recognition. | Tianzi Wang, Shoukang Hu, Jiajun Deng, Zengrui Jin, Mengzhe Geng, Yi Wang, Helen Meng, Xunying Liu |
| 2022 | ICASSP | Exploiting Cross Domain Acoustic-to-Articulatory Inverted Features for Disordered Speech Recognition. | Shujie Hu, Shansong Liu, Xurong Xie, Mengzhe Geng, Tianzi Wang, Shoukang Hu, Mingyu Cui, Xunying Liu, Helen Meng |
| 2022 | ICASSP | Audio-Visual Multi-Channel Speech Separation, Dereverberation and Recognition. | Guinan Li, Jianwei Yu, Jiajun Deng, Xunying Liu, Helen Meng |
| 2022 | ICASSP | A Multitask Learning Framework for Speaker Change Detection with Content Information from Unsupervised Speech Decomposition. | Hang Su, Danyang Zhao, Long Dang, Minglei Li, Xixin Wu, Xunying Liu, Helen Meng |
| 2022 | ICASSP | Speaker Identity Preservation in Dysarthric Speech Reconstruction by Adversarial Speaker Adaptation. | Disong Wang, Songxiang Liu, Xixin Wu, Hui Lu, Lifa Sun, Xunying Liu, Helen Meng |
| 2022 | ICASSP | VCVTS: Multi-Speaker Video-to-Speech Synthesis Via Cross-Modal Knowledge Transfer from Voice Conversion. | Disong Wang, Shan Yang, Dan Su, Xunying Liu, Dong Yu, Helen Meng |
| 2022 | ICASSP | Neural Architecture Search for Speech Emotion Recognition. | Xixin Wu, Shoukang Hu, Zhiyong Wu, Xunying Liu, Helen Meng |
| 2022 | ICASSP | Mixed Precision DNN Quantization for Overlapped Speech Separation and Recognition. | Junhao Xu, Jianwei Yu, Xunying Liu, Helen Meng |
| 2022 | ICASSP | Multi-Channel Speaker Diarization Using Spatial Features for Meetings. | Naijun Zheng, Na Li, Jianwei Yu, Chao Weng, Dan Su, Xunying Liu, Helen Meng |
| 2022 | Interspeech | Two-pass Decoding and Cross-adaptation Based System Combination of End-to-end Conformer and Hybrid TDNN ASR Systems. | Mingyu Cui, Jiajun Deng, Shoukang Hu, Xurong Xie, Tianzi Wang, Shujie Hu, Mengzhe Geng, Boyang Xue, Xunying Liu, Helen Meng |
| 2022 | Interspeech | Confidence Score Based Conformer Speaker Adaptation for Speech Recognition. | Jiajun Deng, Xurong Xie, Tianzi Wang, Mingyu Cui, Boyang Xue, Zengrui Jin, Mengzhe Geng, Guinan Li, Xunying Liu, Helen Meng |
| 2022 | Interspeech | Context-aware Multimodal Fusion for Emotion Recognition. | Jinchao Li, Shuai Wang, Yang Chao, Xunying Liu, Helen Meng |
| 2022 | Interspeech | Conformer Based Elderly Speech Recognition System for Alzheimer's Disease Detection. | Tianzi Wang, Jiajun Deng, Mengzhe Geng, Zi Ye, Shoukang Hu, Yi Wang, Mingyu Cui, Zengrui Jin, Xunying Liu, Helen Meng |
| 2022 | Interspeech | Exploring linguistic feature and model combination for speech recognition based automatic AD detection. | Yi Wang, Tianzi Wang, Zi Ye, Lingwei Meng, Shoukang Hu, Xixin Wu, Xunying Liu, Helen Meng |
| 2022 | Interspeech | Towards Green ASR: Lossless 4-bit Quantization of a Hybrid TDNN System on the 300-hr Swithboard Corpus. | Junhao Xu, Shoukang Hu, Xunying Liu, Helen Meng |
| 2021 | AISTATS | Understanding the wiring evolution in differentiable neural architecture search. | Sirui Xie, Shoukang Hu, Xinjiang Wang, Chunxiao Liu, Jianping Shi, Xunying Liu, Dahua Lin |
| 2021 | ICASSP | Neural Architecture Search for LF-MMI Trained Time Delay Neural Networks. | Shoukang Hu, Xurong Xie, Shansong Liu, Mingyu Cui, Mengzhe Geng, Xunying Liu, Helen Meng |
| 2021 | ICASSP | Replay and Synthetic Speech Detection with Res2Net Architecture. | Xu Li, Na Li, Chao Weng, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2021 | ICASSP | A Comparative Study of Acoustic and Linguistic Features Classification for Alzheimer's Disease Detection. | Jinchao Li, Jianwei Yu, Zi Ye, Simon Wong, Man-Wai Mak, Brian Mak, Xunying Liu, Helen Meng |
| 2021 | ICASSP | Fcl-Taco2: Towards Fast, Controllable and Lightweight Text-to-Speech Synthesis. | Disong Wang, Liqun Deng, Yang Zhang, Nianzu Zheng, Yu Ting Yeung, Xiao Chen, Xunying Liu, Helen Meng |
| 2021 | ICASSP | Bayesian Transformer Language Models for Speech Recognition. | Boyang Xue, Jianwei Yu, Junhao Xu, Shansong Liu, Shoukang Hu, Zi Ye, Mengzhe Geng, Xunying Liu, Helen Meng |
| 2021 | ICASSP | Mixed Precision Quantization of Transformer Language Models for Speech Recognition. | Junhao Xu, Shoukang Hu, Jianwei Yu, Xunying Liu, Helen Meng |
| 2021 | ICASSP | Development of the Cuhk Elderly Speech Recognition System for Neurocognitive Disorder Detection Using the Dementiabank Corpus. | Zi Ye, Shoukang Hu, Jinchao Li, Xurong Xie, Mengzhe Geng, Jianwei Yu, Junhao Xu, Boyang Xue, Shansong Liu, Xunying Liu, Helen Meng |
| 2021 | ICASSP | A Joint Training Framework of Multi-Look Separator and Speaker Embedding Extractor for Overlapped Speech. | Naijun Zheng, Na Li, Bo Wu, Meng Yu, Jianwei Yu, Chao Weng, Dan Su, Xunying Liu, Helen Meng |
| 2021 | Interspeech | Bayesian Parametric and Architectural Domain Adaptation of LF-MMI Trained TDNNs for Elderly and Dysarthric Speech Recognition. | Jiajun Deng, Fabian Ritter Gutierrez, Shoukang Hu, Mengzhe Geng, Xurong Xie, Zi Ye, Shansong Liu, Jianwei Yu, Xunying Liu, Helen Meng |
| 2021 | Interspeech | Spectro-Temporal Deep Features for Disordered Speech Assessment and Recognition. | Mengzhe Geng, Shansong Liu, Jianwei Yu, Xurong Xie, Shoukang Hu, Zi Ye, Zengrui Jin, Xunying Liu, Helen Meng |
| 2021 | Interspeech | Adversarial Data Augmentation for Disordered Speech Recognition. | Zengrui Jin, Mengzhe Geng, Xurong Xie, Jianwei Yu, Shansong Liu, Xunying Liu, Helen Meng |
| 2021 | Interspeech | Channel-Wise Gated Res2Net: Towards Robust Detection of Synthetic Speech Attacks. | Xu Li, Xixin Wu, Hui Lu, Xunying Liu, Helen Meng |
| 2021 | Interspeech | VAENAR-TTS: Variational Auto-Encoder Based Non-AutoRegressive Text-to-Speech Synthesis. | Hui Lu, Zhiyong Wu, Xixin Wu, Xu Li, Shiyin Kang, Xunying Liu, Helen Meng |
| 2021 | Interspeech | VQMIVC: Vector Quantization and Mutual Information-Based Unsupervised Speech Representation Disentanglement for One-Shot Voice Conversion. | Disong Wang, Liqun Deng, Yu Ting Yeung, Xiao Chen, Xunying Liu, Helen Meng |
| 2021 | Interspeech | Unsupervised Domain Adaptation for Dysarthric Speech Detection via Domain Adversarial Training and Mutual Information Minimization. | Disong Wang, Liqun Deng, Yu Ting Yeung, Xiao Chen, Xunying Liu, Helen Meng |
| 2021 | Interspeech | Learning Explicit Prosody Models and Deep Speaker Embeddings for Atypical Voice Conversion. | Disong Wang, Songxiang Liu, Lifa Sun, Xixin Wu, Xunying Liu, Helen Meng |
| 2021 | Interspeech | Variational Auto-Encoder Based Variability Encoding for Dysarthric Speech Recognition. | Xurong Xie, Rukiye Ruzi, Xunying Liu, Lan Wang |
| 2020 | CVPR | DSNAS: Direct Neural Architecture Search Without Parameter Retraining. | Shoukang Hu, Sirui Xie, Hehui Zheng, Chunxiao Liu, Jianping Shi, Xunying Liu, Dahua Lin |
| 2020 | ICASSP | Code-Switched Speech Synthesis Using Bilingual Phonetic Posteriorgram with Only Monolingual Corpora. | Yuewen Cao, Songxiang Liu, Xixin Wu, Shiyin Kang, Peng Liu, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2020 | ICASSP | End-To-End Accent Conversion Without Using Native Utterances. | Songxiang Liu, Disong Wang, Yuewen Cao, Lifa Sun, Xixin Wu, Shiyin Kang, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2020 | ICASSP | Adversarial Attacks on GMM I-Vector Based Speaker Verification Systems. | Xu Li, Jinghua Zhong, Xixin Wu, Jianwei Yu, Xunying Liu, Helen Meng |
| 2020 | ICASSP | End-To-End Voice Conversion Via Cross-Modal Knowledge Distillation for Dysarthric Speech Reconstruction. | Disong Wang, Jianwei Yu, Xixin Wu, Songxiang Liu, Lifa Sun, Xunying Liu, Helen Meng |
| 2020 | ICASSP | Low-bit Quantization of Recurrent Neural Network Language Models Using Alternating Direction Methods of Multipliers. | Junhao Xu, Xie Chen, Shoukang Hu, Jianwei Yu, Xunying Liu, Helen Meng |
| 2020 | ICASSP | Audio-Visual Recognition of Overlapped Speech for the LRS2 Dataset. | Jianwei Yu, Shi-Xiong Zhang, Jian Wu, Shahram Ghorbani, Bo Wu, Shiyin Kang, Shansong Liu, Xunying Liu, Helen Meng, Dong Yu |
| 2020 | Interspeech | Investigation of Data Augmentation Techniques for Disordered Speech Recognition. | Mengzhe Geng, Xurong Xie, Shansong Liu, Jianwei Yu, Shoukang Hu, Xunying Liu, Helen Meng |
| 2020 | Interspeech | Investigating Robustness of Adversarial Samples Detection for Automatic Speaker Verification. | Xu Li, Na Li, Jinghua Zhong, Xixin Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2020 | Interspeech | Transferring Source Style in Non-Parallel Voice Conversion. | Songxiang Liu, Yuewen Cao, Shiyin Kang, Na Hu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2020 | Interspeech | Exploiting Cross-Domain Visual Feature Generation for Disordered Speech Recognition. | Shansong Liu, Xurong Xie, Jianwei Yu, Shoukang Hu, Mengzhe Geng, Rongfeng Su, Shi-Xiong Zhang, Xunying Liu, Helen Meng |
| 2020 | Interspeech | Audio-Visual Multi-Channel Recognition of Overlapped Speech. | Jianwei Yu, Bo Wu, Rongzhi Gu, Shi-Xiong Zhang, Lianwu Chen, Yong Xu, Meng Yu, Dan Su, Dong Yu, Xunying Liu, Helen Meng |
| 2020 | Interspeech | Speaker-Aware Linear Discriminant Analysis in Speaker Verification. | Naijun Zheng, Xixin Wu, Jinghua Zhong, Xunying Liu, Helen Meng |
| 2019 | ICASSP | End-to-end Code-switched TTS with Mix of Monolingual Recordings. | Yuewen Cao, Xixin Wu, Songxiang Liu, Jianwei Yu, Xu Li, Zhiyong Wu, Xunying Liu, Helen Meng |
| 2019 | ICASSP | Bayesian and Gaussian Process Neural Networks for Large Vocabulary Continuous Speech Recognition. | Shoukang Hu, Max W. Y. Lam, Xurong Xie, Shansong Liu, Jianwei Yu, Xixin Wu, Xunying Liu, Helen Meng |
| 2019 | ICASSP | Gaussian Process Lstm Recurrent Neural Network Language Models for Speech Recognition. | Max W. Y. Lam, Xie Chen, Shoukang Hu, Jianwei Yu, Xunying Liu, Helen Meng |
| 2019 | ICASSP | CNN-RNN-CTC Based End-to-end Mispronunciation Detection and Diagnosis. | Wai-Kim Leung, Xunying Liu, Helen Meng |
| 2019 | ICASSP | Speech Emotion Recognition Using Capsule Networks. | Xixin Wu, Songxiang Liu, Yuewen Cao, Xu Li, Jianwei Yu, Dongyang Dai, Xi Ma, Shoukang Hu, Zhiyong Wu, Xunying Liu, Helen Meng |
| 2019 | ICASSP | BLHUC: Bayesian Learning of Hidden Unit Contributions for Deep Neural Network Speaker Adaptation. | Xurong Xie, Xunying Liu, Tan Lee, Shoukang Hu, Lan Wang |
| 2019 | ICASSP | Recurrent Neural Network Language Model Training Using Natural Gradient. | Jianwei Yu, Max W. Y. Lam, Xie Chen, Shoukang Hu, Songxiang Liu, Xixin Wu, Xunying Liu, Helen Meng |
| 2019 | Interspeech | The CUHK Dysarthric Speech Recognition Systems for English and Cantonese. | Shoukang Hu, Shansong Liu, Heng Fai Chang, Mengzhe Geng, Jiani Chen, Lau Wing Chung, To Ka Hei, Jianwei Yu, Ka Ho Wong, Xunying Liu, Helen Meng |
| 2019 | Interspeech | LF-MMI Training of Bayesian and Gaussian Process Time Delay Neural Networks for Speech Recognition. | Shoukang Hu, Xurong Xie, Shansong Liu, Max W. Y. Lam, Jianwei Yu, Xixin Wu, Xunying Liu, Helen Meng |
| 2019 | Interspeech | Extract, Adapt and Recognize: An End-to-End Neural Network for Corrupted Monaural Speech Recognition. | Max W. Y. Lam, Jun Wang, Xunying Liu, Helen Meng, Dan Su, Dong Yu |
| 2019 | Interspeech | Jointly Trained Conversion Model and WaveNet Vocoder for Non-Parallel Voice Conversion Using Mel-Spectrograms and Phonetic Posteriorgrams. | Songxiang Liu, Yuewen Cao, Xixin Wu, Lifa Sun, Xunying Liu, Helen Meng |
| 2019 | Interspeech | On the Use of Pitch Features for Disordered Speech Recognition. | Shansong Liu, Shoukang Hu, Xunying Liu, Helen Meng |
| 2019 | Interspeech | Exploiting Visual Features Using Bayesian Gated Neural Networks for Disordered Speech Recognition. | Shansong Liu, Shoukang Hu, Yi Wang, Jianwei Yu, Rongfeng Su, Xunying Liu, Helen Meng |
| 2019 | Interspeech | Unsupervised Methods for Audio Classification from Lecture Discussion Recordings. | Hang Su, Borislav Dzodzo, Xixin Wu, Xunying Liu, Helen Meng |
| 2019 | Interspeech | Fast DNN Acoustic Model Speaker Adaptation by Learning Hidden Unit Contribution Features. | Xurong Xie, Xunying Liu, Tan Lee, Lan Wang |
| 2019 | Interspeech | Comparative Study of Parametric and Representation Uncertainty Modeling for Recurrent Neural Network Language Models. | Jianwei Yu, Max W. Y. Lam, Shoukang Hu, Xixin Wu, Xu Li, Yuewen Cao, Xunying Liu, Helen Meng |
| 2018 | ICASSP | Limited-Memory BFGS Optimization of Recurrent Neural Network Language Models for Speech Recognition. | Xunying Liu, Shansong Liu, Jinze Sha, Jianwei Yu, Zhiyuan Xu, Xie Chen, Helen Meng |
| 2018 | ICASSP | Unsupervised Discovery of an Extended Phoneme Set in L2 English Speech for Mispronunciation Detection and Diagnosis. | Shaoguang Mao, Xu Li, Kun Li, Zhiyong Wu, Xunying Liu, Helen Meng |
| 2018 | ICASSP | Feature Based Adaptation for Speaking Style Synthesis. | Xixin Wu, Lifa Sun, Shiyin Kang, Songxiang Liu, Zhiyong Wu, Xunying Liu, Helen Meng |
| 2018 | Interspeech | Gaussian Process Neural Networks for Speech Recognition. | Max W. Y. Lam, Shoukang Hu, Xurong Xie, Shansong Liu, Jianwei Yu, Rongfeng Su, Xunying Liu, Helen Meng |
| 2018 | Interspeech | Unsupervised Discovery of Non-native Phonetic Patterns in L2 English Speech for Mispronunciation Detection and Diagnosis. | Xu Li, Shaoguang Mao, Xixin Wu, Kun Li, Xunying Liu, Helen Meng |
| 2018 | Interspeech | Voice Conversion Across Arbitrary Speakers Based on a Single Target-Speaker Utterance. | Songxiang Liu, Jinghua Zhong, Lifa Sun, Xixin Wu, Xunying Liu, Helen Meng |
| 2018 | Interspeech | Semi-supervised Cross-domain Visual Feature Learning for Audio-Visual Broadcast Speech Transcription. | Rongfeng Su, Xunying Liu, Lan Wang |
| 2018 | Interspeech | Rapid Style Adaptation Using Residual Error Embedding for Expressive Speech Synthesis. | Xixin Wu, Yuewen Cao, Mu Wang, Songxiang Liu, Shiyin Kang, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2018 | Interspeech | Development of the CUHK Dysarthric Speech Recognition System for the UA Speech Corpus. | Jianwei Yu, Xurong Xie, Shansong Liu, Shoukang Hu, Max W. Y. Lam, Xixin Wu, Ka Ho Wong, Xunying Liu, Helen Meng |
| 2017 | ICASSP | Recurrent neural network language models for keyword search. | Xie Chen, Anton Ragni, J. Vasilakes, Xunying Liu, Kate M. Knill, Mark J. F. Gales |
| 2017 | ICASSP | Multi-task learning of structured output layer bidirectional LSTMS for speech synthesis. | Runnan Li, Zhiyong Wu, Xunying Liu, Helen M. Meng, Lianhong Cai |
| 2017 | Interspeech | Investigating Bidirectional Recurrent Neural Network Language Models for Speech Recognition. | Xie Chen, Anton Ragni, Xunying Liu, Mark J. F. Gales |
| 2017 | Interspeech | RNN-LDA Clustering for Feature Based DNN Adaptation. | Xurong Xie, Xunying Liu, Tan Lee, Lan Wang |
| 2016 | ICASSP | CUED-RNNLM - An open-source toolkit for efficient training and evaluation of recurrent neural network language models. | Xie Chen, Xunying Liu, Y. Qian, Mark J. F. Gales, Philip C. Woodland |
| 2016 | ICASSP | Improved DNN-based segmentation for multi-genre broadcast audio. | Linlin Wang, Chao Zhang, Philip C. Woodland, Mark J. F. Gales, Panagiota Karanasou, Pierre Lanchantin, Xunying Liu, Yanmin Qian |
| 2016 | Interspeech | Selection of Multi-Genre Broadcast Data for the Training of Automatic Speech Recognition Systems. | Pierre Lanchantin, Mark J. F. Gales, Penny Karanasou, Xunying Liu, Yanman Qian, Linlin Wang, Philip C. Woodland, Chao Zhang |
| 2016 | Interspeech | Deep Neural Network Based Acoustic-to-Articulatory Inversion Using Phone Sequence Information. | Xurong Xie, Xunying Liu, Lan Wang |
| 2015 | ASRU | The MGB challenge: Evaluating multi-genre broadcast media recognition. | Peter Bell, Mark J. F. Gales, Thomas Hain, Jonathan Kilgour, Pierre Lanchantin, Xunying Liu, Andrew McParland, Steve Renals, Oscar Saz, Mirjam Wester, Philip C. Woodland |
| 2015 | ASRU | Investigation of back-off based interpolation between recurrent neural network and n-gram language models. | Xie Chen, Xunying Liu, Mark J. F. Gales, Philip C. Woodland |
| 2015 | ASRU | Speaker diarisation and longitudinal linking in multi-genre broadcast data. | Penny Karanasou, Mark J. F. Gales, Pierre Lanchantin, Xunying Liu, Yanmin Qian, Linlin Wang, Philip C. Woodland, Chao Zhang |
| 2015 | ASRU | The development of the cambridge university alignment systems for the multi-genre broadcast challenge. | Pierre Lanchantin, Mark J. F. Gales, Penny Karanasou, Xunying Liu, Yanmin Qian, Linlin Wang, Philip C. Woodland, Chao Zhang |
| 2015 | ASRU | Cambridge university transcription systems for the multi-genre broadcast challenge. | Philip C. Woodland, Xunying Liu, Yanmin Qian, Chao Zhang, Mark J. F. Gales, Penny Karanasou, Pierre Lanchantin, Linlin Wang |
| 2015 | ICASSP | Improving the training and evaluation efficiency of recurrent neural network language models. | Xie Chen, Xunying Liu, Mark J. F. Gales, Philip C. Woodland |
| 2015 | ICASSP | Recurrent neural network language model training with noise contrastive estimation for speech recognition. | Xie Chen, Xunying Liu, Mark J. F. Gales, Philip C. Woodland |
| 2015 | ICASSP | Paraphrastic recurrent neural network language models. | Xunying Liu, Xie Chen, Mark J. F. Gales, Philip C. Woodland |
| 2015 | Interspeech | Recurrent neural network language model adaptation for multi-genre broadcast speech recognition. | Xie Chen, Tian Tan, Xunying Liu, Pierre Lanchantin, M. Wan, Mark J. F. Gales, Philip C. Woodland |
| 2015 | Interspeech | The Cambridge University 2014 BOLT conversational telephone Mandarin Chinese LVCSR system for speech translation. | Xunying Liu, Federico Flego, Linlin Wang, Chao Zhang, Mark J. F. Gales, Philip C. Woodland |
| 2015 | Interspeech | Efficient use of DNN bottleneck features in generalized variable parameter HMMs for noise robust speech recognition. | Rongfeng Su, Xurong Xie, Xunying Liu, Lan Wang |
| 2015 | Interspeech | Generalized variable parameter HMMs based acoustic-to-articulatory inversion. | Xurong Xie, Xunying Liu, Lan Wang, Rongfeng Su |
| 2014 | ICASSP | Paraphrastic neural network language models. | Xunying Liu, Mark J. F. Gales, Philip C. Woodland |
| 2014 | ICASSP | Efficient lattice rescoring using recurrent neural network language models. | Xunying Liu, Yongqiang Wang, Xie Chen, Mark J. F. Gales, Philip C. Woodland |
| 2014 | Interspeech | Efficient GPU-based training of recurrent neural network language models using spliced sentence bunch. | Xie Chen, Yongqiang Wang, Xunying Liu, Mark J. F. Gales, Philip C. Woodland |
| 2014 | Interspeech | Deep neural network bottleneck features for generalized variable parameter HMMs. | Xurong Xie, Rongfeng Su, Xunying Liu, Lan Wang |
| 2013 | ASRU | Automatic model complexity control for generalized variable parameter HMMs. | Rongfeng Su, Xunying Liu, Lan Wang |
| 2013 | ICASSP | Paraphrastic language models and combination with neural network language models. | Xunying Liu, Mark J. F. Gales, Philip C. Woodland |
| 2013 | Interspeech | Automatic Transcription of Multi-genre Media Archives. | Pierre Lanchantin, Peter Bell, Mark J. F. Gales, Thomas Hain, Xunying Liu, Yanhua Long, Jennifer Quinnell, Steve Renals, Oscar Saz, Matthew Stephen Seigel, Pawel Swietojanski, Philip C. Woodland |
| 2013 | Interspeech | Feature space generalized variable parameter HMMs for noise robust recognition. | Yang Li, Xunying Liu, Lan Wang |
| 2013 | Interspeech | Cross-domain paraphrasing for improving language modelling using out-of-domain data. | Xunying Liu, Mark J. F. Gales, Philip C. Woodland |
| 2013 | Interspeech | Improving lightly supervised training for broadcast transcription. | Yanhua Long, Mark J. F. Gales, Pierre Lanchantin, Xunying Liu, Matthew Stephen Seigel, Philip C. Woodland |
| 2012 | Interspeech | Paraphrastic Language Models. | Xunying Liu, Mark J. F. Gales, Philip C. Woodland |
| 2011 | ICASSP | Investigation of acoustic units for LVCSR systems. | Xunying Liu, Mark John Francis Gales, Jim L. Hieronymus, Philip C. Woodland |
| 2011 | Interspeech | Generalized Variable Parameter HMMs for Noise Robust Speech Recognition. | Ning Cheng, Xunying Liu, Lan Wang |
| 2011 | Interspeech | Word Boundary Modelling and Full Covariance Gaussians for Arabic Speech-to-Text Systems. | Frank Diehl, Mark John Francis Gales, Xunying Liu, Marcus Tomalin, Philip C. Woodland |
| 2011 | Interspeech | Improving LVCSR System Combination Using Neural Network Language Model Cross Adaptation. | Xunying Liu, Mark J. F. Gales, Philip C. Woodland |
| 2010 | ICASSP | Language model combination and adaptation usingweighted finite state transducers. | Xunying Liu, Mark J. F. Gales, Jim L. Hieronymus, Philip C. Woodland |
| 2010 | Interspeech | Language model cross adaptation for LVCSR system combination. | Xunying Liu, Mark J. F. Gales, Philip C. Woodland |
| 2010 | Interspeech | Improved neural network based language modelling and adaptation. | Junho Park, Xunying Liu, Mark J. F. Gales, Philip C. Woodland |
| 2009 | Interspeech | Exploiting Chinese character models to improve speech recognition performance. | Jim L. Hieronymus, Xunying Liu, Mark J. F. Gales, Philip C. Woodland |
| 2009 | Interspeech | Use of contexts in language model interpolation and adaptation. | Xunying Liu, Mark J. F. Gales, Philip C. Woodland |
| 2008 | Interspeech | Context dependent language model adaptation. | Xunying Liu, Mark J. F. Gales, Philip C. Woodland |
| 2007 | ASRU | Discriminative language model adaptation for Mandarin broadcast speech transcription and translation. | Xunying Liu, William J. Byrne, Mark J. F. Gales, Adri de Gispert, Marcus Tomalin, Philip C. Woodland, Kai Yu |
| 2007 | ICASSP | Speech Recognition System Combination for Machine Translation. | Mark J. F. Gales, Xunying Liu, Rohit Sinha, Philip C. Woodland, Kai Yu, Spyros Matsoukas, Tim Ng, Kham Nguyen, Long Nguyen, Jean-Luc Gauvain, Lori Lamel, Abdelkhalek Messaoudi |
| 2005 | ICASSP | Investigation of Acoustic Modeling Techniques for LVCSR Systems. | Xunying Liu, Mark J. F. Gales, Khe Chai Sim, Kai Yu |
| 2004 | ICASSP | Development of the 2003 CU-HTK conversational telephone speech transcription system. | Gunnar Evermann, Ho Yin Chan, Mark J. F. Gales, Thomas Hain, Xunying Liu, David Mrva, Lan Wang, Philip C. Woodland |
| 2004 | ICASSP | Model complexity control and compression using discriminative growth functions. | Xunying Liu, Mark J. F. Gales |
| 2003 | ICASSP | Automatic complexity control for HLDA systems. | Xunying Liu, Mark J. F. Gales, Philip C. Woodland |