| 2025 | Interspeech | GLCLAP: A Novel Contrastive Learning Pre-trained Model for Contextual Biasing in ASR. | Yuxiang Kong, Fan Cui, Liyong Guo, Heinrich Dinkel, Lichun Fan, Junbo Zhang, Jian Luan |
| 2025 | Interspeech | Text-Enhanced Audio Encoder for Large Language Model based Speech Recognition via Cross-Modality Pre-training with Unpaired Audio-Text Data. | Hang Su, Yuxiang Kong, Lichun Fan, Jian Luan |
| 2024 | Interspeech | Speaker Change Detection with Weighted-sum Knowledge Distillation based on Self-supervised Pre-trained Models. | Hang Su, Yuxiang Kong, Lichun Fan, Peng Gao, Yujun Wang, Zhiyong Wu |
| 2023 | ICASSP | Predicting Multi-Codebook Vector Quantization Indexes for Knowledge Distillation. | Liyong Guo, Xiaoyu Yang, Quandong Wang, Yuxiang Kong, Zengwei Yao, Fan Cui, Fangjun Kuang, Wei Kang, Long Lin, Mingshuang Luo, Piotr Zelasko, Daniel Povey |
| 2021 | Interspeech | AISHELL-4: An Open Source Dataset for Speech Enhancement, Separation, Recognition and Speaker Diarization in Conference Scenario. | Yihui Fu, Luyao Cheng, Shubo Lv, Yukai Jv, Yuxiang Kong, Zhuo Chen, Yanxin Hu, Lei Xie, Jian Wu, Hui Bu, Xin Xu, Jun Du, Jingdong Chen |
| 2021 | Interspeech | F-T-LSTM Based Complex Network for Joint Acoustic Echo Cancellation and Speech Enhancement. | Shimin Zhang, Yuxiang Kong, Shubo Lv, Yanxin Hu, Lei Xie |