| 2026 | AAAI | AHAMask: Reliable Task Specification for Large Audio Language Models Without Instructions. | Yiwei Guo, Bohan Li, Hankun Wang, Zhihan Li, Shuai Wang, Xie Chen, Kai Yu |
| 2026 | AAAI | WaveEx: Accelerating Flow Matching-based Speech Generation via Wavelet-guided Extrapolation. | Xiaoqian Liu, Xiyan Gui, Zhengkun Ge, Yuan Ge, Chang Zou, Jiacheng Liu, Zhikang Niu, Qixi Zheng, Chen Xu, Xie Chen, Tong Xiao, Jingbo Zhu, Linfeng Zhang |
| 2026 | ACL | SAC: Neural Speech Codec with Semantic-Acoustic Dual-Stream Quantization. | Wenxi Chen, Ruiqi Yan, Yushen Chen, Zhikang Niu, Ziyang Ma, Xiquan Li, Yuzhe Liang, Wenhan Lin, Shunshun Yin, Ming Tao, Xinsheng Wang, Xie Chen |
| 2026 | ACL | ReStyle-TTS: Relative and Continuous Style Control for Zero-Shot Speech Synthesis. | Haitao Li, Chunxiang Jin, Chenglin Li, Wenhao Guan, Zhengxing Huang, Xie Chen |
| 2026 | ACL | MeanAudio: Fast and Faithful Text-to-Audio Generation with Mean Flows. | Xiquan Li, Junxi Liu, Yuzhe Liang, Zhikang Niu, Wenxi Chen, Xie Chen |
| 2026 | ACL | FineLAP: Taming Heterogeneous Supervision for Fine-grained Language-Audio Pretraining. | Xiquan Li, Xuenan Xu, Ziyang Ma, Wenxi Chen, Haolin He, Qiuqiang Kong, Xie Chen |
| 2026 | ACL | Evaluating the Expressive Appropriateness of Speech in Rich Contexts. | Tianrui Wang, Ziyang Ma, Yizhou Peng, Haoyu Wang, Zhikang Niu, Zikang Huang, Yihao Wu, Yi-Wen Chao, Yu Jiang, Yuheng Lu, Guanrou Yang, Xuanchen Li, Hexin Liu, Chunyu Qiang, Cheng Gong, Yifan Yang, Tianchi Liu, Junyu Wang, Nana Hou, Meng Ge, Fuming You, Yang Wei, Zhongqian Sun, Haifeng Hu, Xiaobao Wang, Eng Siong Chng, Xie Chen, Longbiao Wang, Jianwu Dang |
| 2026 | ACL | Towards Fine-Grained and Multi-Granular Contrastive Language-Speech Pre-training. | Yifan Yang, Bing Han, Hui Wang, Wei Wang, Ziyang Ma, Long Zhou, Zengrui Jin, Guanrou Yang, Tianrui Wang, Xu Tan, Xie Chen |
| 2026 | ACL | Less Languages, Less Tokens: An Efficient Unified Logic Cross-lingual Chain-of-Thought Reasoning Framework. | Chenyuan Zhang, Qiguang Chen, Xie Chen, Zhuotao Tian, Bowen Xing, Meishan Zhang, Libo Qin, Baotian Hu, Min Zhang |
| 2025 | AAAI | VQTalker: Towards Multilingual Talking Avatars Through Facial Motion Tokenization. | Tao Liu, Ziyang Ma, Qi Chen, Feilong Chen, Shuai Fan, Xie Chen, Kai Yu |
| 2025 | AAAI | Language Model Can Listen While Speaking. | Ziyang Ma, Yakun Song, Chenpeng Du, Jian Cong, Zhuo Chen, Yuping Wang, Yuxuan Wang, Xie Chen |
| 2025 | AAAI | Speech Recognition Meets Large Language Model: Benchmarking, Models, and Exploration. | Ziyang Ma, Guanrou Yang, Yifan Yang, Zhifu Gao, Jiaming Wang, Zhihao Du, Fan Yu, Qian Chen, Siqi Zheng, Shiliang Zhang, Xie Chen |
| 2025 | AAAI | ELLA-V: Stable Neural Codec Language Modeling with Alignment-Guided Sequence Reordering. | Yakun Song, Zhuo Chen, Xiaofei Wang, Ziyang Ma, Xie Chen |
| 2025 | ACL | Towards Reliable Large Audio Language Model. | Ziyang Ma, Xiquan Li, Yakun Song, Wenxi Chen, Chenpeng Du, Jian Wu, Yuanzhe Chen, Zhuo Chen, Yuping Wang, Yuxuan Wang, Xie Chen |
| 2025 | ACL | GigaSpeech 2: An Evolving, Large-Scale and Multi-domain ASR Corpus for Low-Resource Languages with Automated Crawling, Transcription and Refinement. | Yifan Yang, Zheshu Song, Jianheng Zhuo, Mingyu Cui, Jinpeng Li, Bo Yang, Yexing Du, Ziyang Ma, Xunying Liu, Ziyuan Wang, Ke Li, Shuai Fan, Kai Yu, Wei-Qiang Zhang, Guoguo Chen, Xie Chen |
| 2025 | ACL | SLAM-Omni: Timbre-Controllable Voice Interaction System with Single-Stage Training. | Wenxi Chen, Ziyang Ma, Ruiqi Yan, Yuzhe Liang, Xiquan Li, Ruiyang Xu, Zhikang Niu, Yanqiao Zhu, Yifan Yang, Zhanxun Liu, Kai Yu, Yuxuan Hu, Jinyu Li, Yan Lu, Shujie Liu, Xie Chen |
| 2025 | ACL | F5-TTS: A Fairytaler that Fakes Fluent and Faithful Speech with Flow Matching. | Yushen Chen, Zhikang Niu, Ziyang Ma, Keqi Deng, Chunhui Wang, Jian Zhao, Kai Yu, Xie Chen |
| 2025 | ACL | SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation. | Keqi Deng, Wenxi Chen, Xie Chen, Philip C. Woodland |
| 2025 | ACL | Making LLMs Better Many-to-Many Speech-to-Text Translators with Curriculum Learning. | Yexing Du, Youcheng Pan, Ziyang Ma, Bo Yang, Yifan Yang, Keqi Deng, Xie Chen, Yang Xiang, Ming Liu, Bing Qin |
| 2025 | ASRU | Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model. | Ziyang Ma, Zhuo Chen, Yuping Wang, Eng Siong Chng, Xie Chen |
| 2025 | ASRU | ZO-ASR: Zeroth-Order Fine-Tuning of Speech Foundation Models without Back-Propagation. | Yuezhang Peng, Yuxin Liu, Yao Li, Sheng Wang, Fei Wen, Xie Chen |
| 2025 | ASRU | Towards General Discrete Speech Codec for Complex Acoustic Environments: A Study of Reconstruction and Downstream Task Consistency. | Haoran Wang, Guanyu Chen, Bohan Li, Hankun Wang, Yiwei Guo, Zhihan Li, Xie Chen, Kai Yu |
| 2025 | EMNLP | Enhancing Speech-to-Speech Dialogue Modeling with End-to-End Retrieval-Augmented Generation. | Pengchao Feng, Ziyang Ma, Wenxi Chen, Yao Li, Sheng Wang, Kai Yu, Xie Chen |
| 2025 | EMNLP | MUZO: Leveraging Multiple Queries and Momentum for Zeroth-Order Fine-Tuning of Large Language Models. | Yuezhang Peng, Yuxin Liu, Fei Wen, Xie Chen |
| 2025 | EMNLP | URO-Bench: Towards Comprehensive Evaluation for End-to-End Spoken Dialogue Models. | Ruiqi Yan, Xiquan Li, Wenxi Chen, Zhikang Niu, Chen Yang, Ziyang Ma, Kai Yu, Xie Chen |
| 2025 | ICASSP | SLAM-AAC: Enhancing Audio Captioning with Paraphrasing Augmentation and CLAP-Refine through LLMs. | Wenxi Chen, Ziyang Ma, Xiquan Li, Xuenan Xu, Yuzhe Liang, Zhisheng Zheng, Kai Yu, Xie Chen |
| 2025 | ICASSP | VALL-T: Decoder-Only Generative Transducer for Robust and Decoding-Controllable Text-to-Speech. | Chenpeng Du, Yiwei Guo, Hankun Wang, Yifan Yang, Zhikang Niu, Shuai Wang, Hui Zhang, Xie Chen, Kai Yu |
| 2025 | ICASSP | DRCap: Decoding CLAP Latents with Retrieval-Augmented Generation for Zero-shot Audio Captioning. | Xiquan Li, Wenxi Chen, Ziyang Ma, Xuenan Xu, Yuzhe Liang, Zhisheng Zheng, Qiuqiang Kong, Xie Chen |
| 2025 | ICASSP | Enhancing Low-Resource ASR through Versatile TTS: Bridging the Data Gap. | Guanrou Yang, Fan Yu, Ziyang Ma, Zhihao Du, Zhifu Gao, Shiliang Zhang, Xie Chen |
| 2025 | ICCV | Bitrate-Controlled Diffusion for Disentangling Motion and Content in Video. | Xiao Li, Qi Chen, Xiulian Peng, Kai Yu, Xie Chen, Yan Lu |
| 2025 | Interspeech | Accelerating Diffusion-based Text-to-Speech Model Trainingwith Dual Modality Alignment. | Jeongsoo Choi, Zhikang Niu, Ji-Hoon Kim, Chunhui Wang, Joon Son Chung, Xie Chen |
| 2025 | Interspeech | Exploring SSL Discrete Speech Features for Zipformer-based Contextual ASR. | Mingyu Cui, Yifan Yang, Jiajun Deng, Jiawen Kang, Shujie Hu, Tianzi Wang, Zhaoqing Li, Shiliang Zhang, Xie Chen, Xunying Liu |
| 2025 | Interspeech | LSCodec: Low-Bitrate and Speaker-Decoupled Discrete Speech Codec. | Yiwei Guo, Zhihan Li, Chenpeng Du, Hankun Wang, Xie Chen, Kai Yu |
| 2025 | Interspeech | Empowering Large Language Models for End-to-End Speech Translation Leveraging Synthetic Data. | Yu Pu, Xiaoqian Liu, Guangyu Zhang, Zheng Yan, Wei-Qiang Zhang, Xie Chen |
| 2025 | Interspeech | Unlocking Temporal Flexibility: Neural Speech Codec with Variable Frame Rate. | Hanglei Zhang, Yiwei Guo, Zhihan Li, Xiang Hao, Xie Chen, Kai Yu |
| 2025 | Interspeech | Accelerating Flow-Matching-Based Text-to-Speech via Empirically Pruned Step Sampling. | Qixi Zheng, Yushen Chen, Zhikang Niu, Ziyang Ma, Xiaofei Wang, Kai Yu, Xie Chen |
| 2025 | Interspeech | VietASR: Achieving Industry-level Vietnamese ASR with 50-hour labeled data and Large-Scale Speech Pretraining. | Jianheng Zhuo, Yifan Yang, Yiwen Shao, Yong Xu, Dong Yu, Kai Yu, Xie Chen |
| 2024 | AAAI | UniCATS: A Unified Context-Aware Text-to-Speech Framework with Contextual VQ-Diffusion and Vocoding. | Chenpeng Du, Yiwei Guo, Feiyu Shen, Zhijun Liu, Zheng Liang, Xie Chen, Shuai Wang, Hui Zhang, Kai Yu |
| 2024 | ACL | emotion2vec: Self-Supervised Pre-Training for Speech Emotion Representation. | Ziyang Ma, Zhisheng Zheng, Jiaxin Ye, Jinchao Li, Zhifu Gao, Shiliang Zhang, Xie Chen |
| 2024 | ICASSP | VoiceFlow: Efficient Text-To-Speech with Rectified Flow Matching. | Yiwei Guo, Chenpeng Du, Ziyang Ma, Xie Chen, Kai Yu |
| 2024 | ICASSP | SEF-VC: Speaker Embedding Free Zero-Shot Voice Conversion with Cross Attention. | Junjie Li, Yiwei Guo, Xie Chen, Kai Yu |
| 2024 | ICASSP | StoryTTS: A Highly Expressive Text-to-Speech Dataset with Rich Textual Expressiveness Annotations. | Sen Liu, Yiwei Guo, Xie Chen, Kai Yu |
| 2024 | ICASSP | Leveraging Speech PTM, Text LLM, And Emotional TTS For Speech Emotion Recognition. | Ziyang Ma, Wen Wu, Zhisheng Zheng, Yiwei Guo, Qian Chen, Shiliang Zhang, Xie Chen |
| 2024 | ICASSP | Acoustic BPE for Speech Generation with Discrete Tokens. | Feiyu Shen, Yiwei Guo, Chenpeng Du, Xie Chen, Kai Yu |
| 2024 | ICASSP | Towards Universal Speech Discrete Tokens: A Case Study for ASR and TTS. | Yifan Yang, Feiyu Shen, Chenpeng Du, Ziyang Ma, Kai Yu, Daniel Povey, Xie Chen |
| 2024 | ICML | BAT: Learning to Reason about Spatial Sounds with Large Language Models. | Zhisheng Zheng, Puyuan Peng, Ziyang Ma, Xie Chen, Eunsol Choi, David Harwath |
| 2024 | IJCAI | EAT: Self-Supervised Pre-Training with Efficient Audio Transformer. | Wenxi Chen, Yuzhe Liang, Ziyang Ma, Zhisheng Zheng, Xie Chen |
| 2024 | Interspeech | The Interspeech 2024 Challenge on Speech Processing Using Discrete Units. | Xuankai Chang, Jiatong Shi, Jinchuan Tian, Yuning Wu, Yuxun Tang, Yihan Wu, Shinji Watanabe, Yossi Adi, Xie Chen, Qin Jin |
| 2024 | Interspeech | AnoPatch: Towards Better Consistency in Machine Anomalous Sound Detection. | Anbai Jiang, Bing Han, Zhiqiang Lv, Yufeng Deng, Wei-Qiang Zhang, Xie Chen, Yanmin Qian, Jia Liu, Pingyi Fan |
| 2024 | Interspeech | On the Effectiveness of Acoustic BPE in Decoder-Only TTS. | Bohan Li, Feiyu Shen, Yiwei Guo, Shuai Wang, Xie Chen, Kai Yu |
| 2024 | Interspeech | Improved Factorized Neural Transducer Model For Text-only Domain Adaptation. | Junzhe Liu, Jianwei Yu, Xie Chen |
| 2024 | Interspeech | EmoBox: Multilingual Multi-corpus Speech Emotion Recognition Toolkit and Benchmark. | Ziyang Ma, Mingjie Chen, Hezhao Zhang, Zhisheng Zheng, Wenxi Chen, Xiquan Li, Jiaxin Ye, Xie Chen, Thomas Hain |
| 2024 | Interspeech | TacoLM: GaTed Attention Equipped Codec Language Model are Efficient Zero-Shot Text to Speech Synthesizers. | Yakun Song, Zhuo Chen, Xiaofei Wang, Ziyang Ma, Guanrou Yang, Xie Chen |
| 2024 | Interspeech | LoRA-Whisper: Parameter-Efficient and Extensible Multilingual ASR. | Zheshu Song, Jianheng Zhuo, Yifan Yang, Ziyang Ma, Shixiong Zhang, Xie Chen |
| 2024 | Interspeech | Incorporating Class-based Language Model for Named Entity Recognition in Factorized Neural Transducer. | Peng Wang, Yifan Yang, Zheng Liang, Tian Tan, Shiliang Zhang, Xie Chen |
| 2024 | Interspeech | MaLa-ASR: Multimedia-Assisted LLM-Based ASR. | Guanrou Yang, Ziyang Ma, Fan Yu, Zhifu Gao, Shiliang Zhang, Xie Chen |
| 2023 | ASRU | Exploring Effective Distillation of Self-Supervised Speech Models for Automatic Speech Recognition. | Yujin Wang, Changli Tang, Ziyang Ma, Zhisheng Zheng, Xie Chen, Wei-Qiang Zhang |
| 2023 | ASRU | Fast-Hubert: an Efficient Training Framework for Self-Supervised Speech Representation Learning. | Guanrou Yang, Ziyang Ma, Zhisheng Zheng, Yakun Song, Zhikang Niu, Xie Chen |
| 2023 | ICASSP | Improving Few-Shot Learning for Talking Face System with TTS Data Augmentation. | Qi Chen, Ziyang Ma, Tao Liu, Xu Tan, Qu Lu, Kai Yu, Xie Chen |
| 2023 | ICASSP | Front-End Adapter: Adapting Front-End Input of Speech Based Self-Supervised Learning for Speech Recognition. | Xie Chen, Ziyang Ma, Changli Tang, Yujin Wang, Zhisheng Zheng |
| 2023 | ICASSP | LongFNT: Long-Form Speech Recognition with Factorized Neural Transducer. | Xun Gong, Yu Wu, Jinyu Li, Shujie Liu, Rui Zhao, Xie Chen, Yanmin Qian |
| 2023 | ICASSP | Factorized AED: Factorized Attention-Based Encoder-Decoder for Text-Only Domain Adaptive ASR. | Xun Gong, Wei Wang, Hang Shao, Xie Chen, Yanmin Qian |
| 2023 | ICASSP | Emodiff: Intensity Controllable Emotional Text-to-Speech with Soft-Label Guidance. | Yiwei Guo, Chenpeng Du, Xie Chen, Kai Yu |
| 2023 | ICASSP | An Adapter Based Multi-Label Pre-Training for Speech Separation and Enhancement. | Tianrui Wang, Xie Chen, Zhuo Chen, Shu Yu, Weibin Zhu |
| 2023 | Interspeech | Towards Effective and Compact Contextual Representation for Conformer Transducer Speech Recognition Systems. | Mingyu Cui, Jiawen Kang, Jiajun Deng, Xi Yin, Yutao Xie, Xie Chen, Xunying Liu |
| 2023 | Interspeech | Improving Code-Switching and Name Entity Recognition in ASR with Speech Editing based Data Augmentation. | Zheng Liang, Zheshu Song, Ziyang Ma, Chenpeng Du, Kai Yu, Xie Chen |
| 2023 | Interspeech | DSE-TTS: Dual Speaker Embedding for Cross-Lingual Text-to-Speech. | Sen Liu, Yiwei Guo, Chenpeng Du, Xie Chen, Kai Yu |
| 2023 | Interspeech | MT4SSL: Boosting Self-Supervised Speech Representation Learning by Integrating Multiple Targets. | Ziyang Ma, Zhisheng Zheng, Changli Tang, Yujin Wang, Xie Chen |
| 2023 | Interspeech | Pushing the Limits of Unsupervised Unit Discovery for SSL Speech Representation. | Ziyang Ma, Zhisheng Zheng, Guanrou Yang, Yu Wang, Chao Zhang, Xie Chen |
| 2023 | Interspeech | Blank-regularized CTC for Frame Skipping in Neural Transducer. | Yifan Yang, Xiaoyu Yang, Liyong Guo, Zengwei Yao, Wei Kang, Fangjun Kuang, Long Lin, Xie Chen, Daniel Povey |
| 2023 | Interspeech | Unsupervised Active Learning: Optimizing Labeling Cost-Effectiveness for Automatic Speech Recognition. | Zhisheng Zheng, Ziyang Ma, Yu Wang, Xie Chen |
| 2022 | ICASSP | Factorized Neural Transducer for Efficient Language Model Adaptation. | Xie Chen, Zhong Meng, Sarangarajan Parthasarathy, Jinyu Li |
| 2022 | Interspeech | VQTTS: High-Fidelity Text-to-Speech Synthesis with Self-Supervised VQ Acoustic Feature. | Chenpeng Du, Yiwei Guo, Xie Chen, Kai Yu |
| 2022 | Interspeech | Internal Language Model Adaptation with Text-Only Data for End-to-End Speech Recognition. | Zhong Meng, Yashesh Gaur, Naoyuki Kanda, Jinyu Li, Xie Chen, Yu Wu, Yifan Gong |
| 2021 | ICASSP | Developing Real-Time Streaming Transformer Transducer for Speech Recognition on Large-Scale Dataset. | Xie Chen, Yu Wu, Zhenghao Wang, Shujie Liu, Jinyu Li |
| 2021 | ICASSP | Internal Language Model Training for Domain-Adaptive End-To-End Speech Recognition. | Zhong Meng, Naoyuki Kanda, Yashesh Gaur, Sarangarajan Parthasarathy, Eric Sun, Liang Lu, Xie Chen, Jinyu Li, Yifan Gong |
| 2021 | ICML | Memory-Efficient Pipeline-Parallel DNN Training. | Deepak Narayanan, Amar Phanishayee, Kaiyu Shi, Xie Chen, Matei Zaharia |
| 2021 | ICRA | Micro Robotic Manipulation System for the Force Stimulation of Muscle Fiber-like Cell Structure. | Xie Chen, Qing Shi, Shingo Shimoda, Tao Sun, Huaping Wang, Qiang Huang, Toshio Fukuda |
| 2021 | Interspeech | Improving RNN-T for Domain Scaling Using Semi-Supervised Training with Neural TTS. | Yan Deng, Rui Zhao, Zhong Meng, Xie Chen, Bing Liu, Jinyu Li, Yifan Gong, Lei He |
| 2021 | Interspeech | Minimum Word Error Rate Training with Language Model Fusion for End-to-End Speech Recognition. | Zhong Meng, Yu Wu, Naoyuki Kanda, Liang Lu, Xie Chen, Guoli Ye, Eric Sun, Jinyu Li, Yifan Gong |
| 2020 | ICASSP | Low-bit Quantization of Recurrent Neural Network Language Models Using Alternating Direction Methods of Multipliers. | Junhao Xu, Xie Chen, Shoukang Hu, Jianwei Yu, Xunying Liu, Helen Meng |
| 2019 | ICASSP | Investigation of Sampling Techniques for Maximum Entropy Language Modeling Training. | Xie Chen, Jun Zhang, Tasos Anastasakos, Fil Alleva |
| 2019 | ICASSP | Gaussian Process Lstm Recurrent Neural Network Language Models for Speech Recognition. | Max W. Y. Lam, Xie Chen, Shoukang Hu, Jianwei Yu, Xunying Liu, Helen Meng |
| 2019 | ICASSP | Recurrent Neural Network Language Model Training Using Natural Gradient. | Jianwei Yu, Max W. Y. Lam, Xie Chen, Shoukang Hu, Songxiang Liu, Xixin Wu, Xunying Liu, Helen Meng |
| 2018 | ICASSP | Limited-Memory BFGS Optimization of Recurrent Neural Network Language Models for Speech Recognition. | Xunying Liu, Shansong Liu, Jinze Sha, Jianwei Yu, Zhiyuan Xu, Xie Chen, Helen Meng |
| 2018 | ICASSP | Phonetic and Graphemic Systems for Multi-Genre Broadcast Transcription. | Yu Wang, Xie Chen, Mark J. F. Gales, Anton Ragni, Jeremy Heng Meng Wong |
| 2018 | ICASSP | Neural Network Language Modeling with Letter-Based Features and Importance Sampling. | Hainan Xu, Ke Li, Yiming Wang, Jian Wang, Shiyin Kang, Xie Chen, Daniel Povey, Sanjeev Khudanpur |
| 2018 | Interspeech | Active Memory Networks for Language Modeling. | Oscar Chen, Anton Ragni, Mark J. F. Gales, Xie Chen |
| 2017 | ASRU | Future word contexts in neural network language models. | Xie Chen, X. Liu, Anton Ragni, Y. Wang, Mark J. F. Gales |
| 2017 | ICASSP | Recurrent neural network language models for keyword search. | Xie Chen, Anton Ragni, J. Vasilakes, Xunying Liu, Kate M. Knill, Mark J. F. Gales |
| 2017 | ICONIP | Exploiting the Tibetan Radicals in Recurrent Neural Network for Low-Resource Language Models. | Tongtong Shen, Longbiao Wang, Xie Chen, Kuntharrgyal Khysru, Jianwu Dang |
| 2017 | Interspeech | Investigating Bidirectional Recurrent Neural Network Language Models for Speech Recognition. | Xie Chen, Anton Ragni, Xunying Liu, Mark J. F. Gales |
| 2016 | APNOMS | Power modeling of BSs based on energy storage monitoring. | Xie Chen, Ao Xiong, Peng Yu, Wenjing Li, Mingxiong Wang |
| 2016 | ICASSP | CUED-RNNLM - An open-source toolkit for efficient training and evaluation of recurrent neural network language models. | Xie Chen, Xunying Liu, Y. Qian, Mark J. F. Gales, Philip C. Woodland |
| 2016 | Interspeech | Multi-Language Neural Network Language Models. | Anton Ragni, Edgar Dakin, Xie Chen, Mark J. F. Gales, Kate M. Knill |
| 2015 | ASRU | Investigation of back-off based interpolation between recurrent neural network and n-gram language models. | Xie Chen, Xunying Liu, Mark J. F. Gales, Philip C. Woodland |
| 2015 | ICASSP | Improving the training and evaluation efficiency of recurrent neural network language models. | Xie Chen, Xunying Liu, Mark J. F. Gales, Philip C. Woodland |
| 2015 | ICASSP | Recurrent neural network language model training with noise contrastive estimation for speech recognition. | Xie Chen, Xunying Liu, Mark J. F. Gales, Philip C. Woodland |
| 2015 | ICASSP | Robust excitation-based features for Automatic Speech Recognition. | Thomas Drugman, Yannis Stylianou, Langzhou Chen, Xie Chen, Mark J. F. Gales |
| 2015 | ICASSP | Paraphrastic recurrent neural network language models. | Xunying Liu, Xie Chen, Mark J. F. Gales, Philip C. Woodland |
| 2015 | Interspeech | Recurrent neural network language model adaptation for multi-genre broadcast speech recognition. | Xie Chen, Tian Tan, Xunying Liu, Pierre Lanchantin, M. Wan, Mark J. F. Gales, Philip C. Woodland |
| 2014 | ICASSP | Efficient lattice rescoring using recurrent neural network language models. | Xunying Liu, Yongqiang Wang, Xie Chen, Mark J. F. Gales, Philip C. Woodland |
| 2014 | ICASSP | Impact of single-microphone dereverberation on DNN-based meeting transcription systems. | Takuya Yoshioka, Xie Chen, Mark J. F. Gales |
| 2014 | Interspeech | An initial investigation of long-term adaptation for meeting transcription. | Xie Chen, Mark J. F. Gales, Kate M. Knill, Catherine Breslin, Langzhou Chen, K. K. Chin, Vincent Wan |
| 2014 | Interspeech | Efficient GPU-based training of recurrent neural network language models using spliced sentence bunch. | Xie Chen, Yongqiang Wang, Xunying Liu, Mark J. F. Gales, Philip C. Woodland |
| 2012 | Interspeech | Pipelined Back-Propagation for Context-Dependent Deep Neural Networks. | Xie Chen, Adam Eversole, Gang Li, Dong Yu, Frank Seide |
| 2011 | ASRU | Feature engineering in Context-Dependent Deep Neural Networks for conversational speech transcription. | Frank Seide, Gang Li, Xie Chen, Dong Yu |
| 2003 | SMC | A novel artificial immune model based on error control. | Wataru Uemura, Shoji Tatsumi, Xie Chen |
| 1988 | ICASSP | Maximum likelihood decision for recognition of noisy shapes. | Kie-Bum Eom, Xie Chen |