| 2025 | ASRU | Customizing Speech Recognition Model with Large Language Model Feedback. | Shaoshi Ling, Guoli Ye |
| 2025 | ICASSP | Efficient Long-Form Speech Recognition for General Speech In-Context Learning. | Hao Yen, Shaoshi Ling, Guoli Ye |
| 2024 | ICASSP | Adapting Large Language Model with Speech for Fully Formatted End-to-End Speech Recognition. | Shaoshi Ling, Yuxuan Hu, Shuangbei Qian, Guoli Ye, Yao Qian, Yifan Gong, Ed Lin, Michael Zeng |
| 2023 | ASRU | Multi Transcription-Style Speech Transcription Using Attention-Based Encoder-Decoder Model. | Yan Huang, Piyush Behre, Guoli Ye, Shawn Chang, Yifan Gong |
| 2022 | ICASSP | Have Best of Both Worlds: Two-Pass Hybrid and E2E Cascading Framework for Speech Recognition. | Guoli Ye, Vadim Mazalov, Jinyu Li, Yifan Gong |
| 2021 | Interspeech | Rapid Speaker Adaptation for Conformer Transducer: Attention and Bias Are All You Need. | Yan Huang, Guoli Ye, Jinyu Li, Yifan Gong |
| 2021 | Interspeech | End-to-End Speaker-Attributed ASR with Transformer. | Naoyuki Kanda, Guoli Ye, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Zhuo Chen, Takuya Yoshioka |
| 2021 | Interspeech | Large-Scale Pre-Training of End-to-End Multi-Talker ASR for Meeting Transcription with Single Distant Microphone. | Naoyuki Kanda, Guoli Ye, Yu Wu, Yashesh Gaur, Xiaofei Wang, Zhong Meng, Zhuo Chen, Takuya Yoshioka |
| 2021 | Interspeech | Minimum Word Error Rate Training with Language Model Fusion for End-to-End Speech Recognition. | Zhong Meng, Yu Wu, Naoyuki Kanda, Liang Lu, Xie Chen, Guoli Ye, Eric Sun, Jinyu Li, Yifan Gong |
| 2020 | ICASSP | Adaptation of RNN Transducer with Text-To-Speech Technology for Keyword Spotting. | Eva Sharma, Guoli Ye, Wenning Wei, Rui Zhao, Yao Tian, Jian Wu, Lei He, Ed Lin, Yifan Gong |
| 2020 | Interspeech | Semantic Mask for Transformer Based End-to-End Speech Recognition. | Chengyi Wang, Yu Wu, Yujiao Du, Jinyu Li, Shujie Liu, Liang Lu, Shuo Ren, Guoli Ye, Sheng Zhao, Ming Zhou |
| 2020 | Interspeech | Low Latency End-to-End Streaming Speech Recognition with a Scout Network. | Chengyi Wang, Yu Wu, Liang Lu, Shujie Liu, Jinyu Li, Guoli Ye, Ming Zhou |
| 2019 | ICASSP | Towards Code-switching ASR for End-to-end CTC Models. | Ke Li, Jinyu Li, Guoli Ye, Rui Zhao, Yifan Gong |
| 2018 | ICASSP | Exploring Sequential Characteristics in Speaker Bottleneck Feature for Text-Dependent Speaker Verification. | Liping Chen, Yong Zhao, Shi-Xiong Zhang, Jie Li, Guoli Ye, Frank K. Soong |
| 2018 | ICASSP | Advancing Acoustic-to-Word CTC Model. | Jinyu Li, Guoli Ye, Amit Das, Rui Zhao, Yifan Gong |
| 2018 | ICASSP | Developing Far-Field Speaker System Via Teacher-Student Learning. | Jinyu Li, Rui Zhao, Zhuo Chen, Changliang Liu, Xiong Xiao, Guoli Ye, Yifan Gong |
| 2017 | ASRU | Acoustic-to-word model without OOV. | Jinyu Li, Guoli Ye, Rui Zhao, Jasha Droppo, Yifan Gong |
| 2016 | ICASSP | Geo-location dependent deep neural network acoustic model for speech recognition. | Guoli Ye, Chaojun Liu, Yifan Gong |
| 2016 | Interspeech | Deep Convolutional Neural Networks with Layer-Wise Context Expansion and Attention. | Dong Yu, Wayne Xiong, Jasha Droppo, Andreas Stolcke, Guoli Ye, Jinyu Li, Geoffrey Zweig |
| 2012 | ICASSP | Transition probabilities are more important than we once thought. | Guoli Ye, Dongpeng Chen, Brian Mak |
| 2010 | Interspeech | The use of subvector quantization and discrete densities for fast GMM computation for speaker verification. | Guoli Ye, Brian Mak |
| 2009 | Interspeech | Fast GMM computation for speaker verification using scalar quantization and discrete densities. | Guoli Ye, Brian Mak, Man-Wai Mak |