| 2024 | Interspeech | MSR-86K: An Evolving, Multilingual Corpus with 86, 300 Hours of Transcribed Audio for Speech Recognition Research. | Song Li, Yongbin You, Xuezhi Wang, Zhengkun Tian, Ke Ding, Guanglu Wan |
| 2023 | ICASSP | Peak-First CTC: Reducing the Peak Latency of CTC Models by Applying Peak-First Regularization. | Zhengkun Tian, Hongyu Xiang, Min Li, Feifei Lin, Ke Ding, Guanglu Wan |
| 2022 | ICASSP | End-to-End Network Based on Transformer for Automatic Detection of Covid-19. | Cong Cai, Bin Liu, Jianhua Tao, Zhengkun Tian, Jiahao Lu, Kexin Wang |
| 2022 | ICASSP | ADD 2022: the first Audio Deep Synthesis Detection Challenge. | Jiangyan Yi, Ruibo Fu, Jianhua Tao, Shuai Nie, Haoxin Ma, Chenglong Wang, Tao Wang, Zhengkun Tian, Ye Bai, Cunhang Fan, Shan Liang, Shiming Wang, Shuai Zhang, Xinrui Yan, Le Xu, Zhengqi Wen, Haizhou Li |
| 2022 | Interspeech | reducing multilingual context confusion for end-to-end code-switching automatic speech recognition. | Shuai Zhang, Jiangyan Yi, Zhengkun Tian, Jianhua Tao, Yu Ting Yeung, Liqun Deng |
| 2021 | ACL | A Large-Scale Chinese Multimodal NER Dataset with Speech Clues. | Dianbo Sui, Zhengkun Tian, Yubo Chen, Kang Liu, Jun Zhao |
| 2021 | ICASSP | Decoupling Pronunciation and Language for End-to-End Code-Switching Automatic Speech Recognition. | Shuai Zhang, Jiangyan Yi, Zhengkun Tian, Ye Bai, Jianhua Tao, Zhengqi Wen |
| 2021 | Interspeech | End-to-End Spelling Correction Conditioned on Acoustic Feature for Code-Switching Speech Recognition. | Shuai Zhang, Jiangyan Yi, Zhengkun Tian, Ye Bai, Jianhua Tao, Xuefei Liu, Zhengqi Wen |
| 2021 | Interspeech | Continual Learning for Fake Audio Detection. | Haoxin Ma, Jiangyan Yi, Jianhua Tao, Ye Bai, Zhengkun Tian, Chenglong Wang |
| 2021 | Interspeech | FSR: Accelerating the Inference Process of Transducer-Based Models by Applying Fast-Skip Regularization. | Zhengkun Tian, Jiangyan Yi, Ye Bai, Jianhua Tao, Shuai Zhang, Zhengqi Wen |
| 2021 | Interspeech | Half-Truth: A Partially Fake Audio Detection Dataset. | Jiangyan Yi, Ye Bai, Jianhua Tao, Haoxin Ma, Zhengkun Tian, Chenglong Wang, Tao Wang, Ruibo Fu |
| 2020 | ICASSP | Synchronous Transformers for end-to-end Speech Recognition. | Zhengkun Tian, Jiangyan Yi, Ye Bai, Jianhua Tao, Shuai Zhang, Zhengqi Wen |
| 2020 | Interspeech | Listen Attentively, and Spell Once: Whole Sentence Generation via a Non-Autoregressive Architecture for Low-Latency Speech Recognition. | Ye Bai, Jiangyan Yi, Jianhua Tao, Zhengkun Tian, Zhengqi Wen, Shuai Zhang |
| 2020 | Interspeech | Spike-Triggered Non-Autoregressive Transformer for End-to-End Speech Recognition. | Zhengkun Tian, Jiangyan Yi, Jianhua Tao, Ye Bai, Shuai Zhang, Zhengqi Wen |
| 2020 | Interspeech | Focal Loss for Punctuation Prediction. | Jiangyan Yi, Jianhua Tao, Zhengkun Tian, Ye Bai, Cunhang Fan |
| 2019 | Interspeech | Learn Spelling from Teachers: Transferring Knowledge from Language Models to Sequence-to-Sequence Speech Recognition. | Ye Bai, Jiangyan Yi, Jianhua Tao, Zhengkun Tian, Zhengqi Wen |
| 2019 | Interspeech | A Time Delay Neural Network with Shared Weight Self-Attention for Small-Footprint Keyword Spotting. | Ye Bai, Jiangyan Yi, Jianhua Tao, Zhengqi Wen, Zhengkun Tian, Chenghao Zhao, Cunhang Fan |
| 2019 | Interspeech | Self-Attention Transducers for End-to-End Speech Recognition. | Zhengkun Tian, Jiangyan Yi, Jianhua Tao, Ye Bai, Zhengqi Wen |