| 2021 | Interspeech | Non-Parallel Any-to-Many Voice Conversion by Replacing Speaker Statistics. | Yufei Liu, Chengzhu Yu, Shuai Wang, Zhenchuan Yang, Yang Chao, Weibin Zhang |
| 2020 | ICASSP | Pitchnet: Unsupervised Singing Voice Conversion with Pitch Adversarial Network. | Chengqi Deng, Chengzhu Yu, Heng Lu, Chao Weng, Dong Yu |
| 2020 | Interspeech | Minimum Bayes Risk Training of RNN-Transducer for End-to-End Speech Recognition. | Chao Weng, Chengzhu Yu, Jia Cui, Chunlei Zhang, Dong Yu |
| 2020 | Interspeech | Peking Opera Synthesis via Duration Informed Attention Network. | Yusong Wu, Shengchen Li, Chengzhu Yu, Heng Lu, Chao Weng, Liqiang Zhang, Dong Yu |
| 2020 | Interspeech | DurIAN: Duration Informed Attention Network for Speech Synthesis. | Chengzhu Yu, Heng Lu, Na Hu, Meng Yu, Chao Weng, Kun Xu, Peng Liu, Deyi Tuo, Shiyin Kang, Guangzhi Lei, Dan Su, Dong Yu |
| 2020 | Interspeech | DurIAN-SC: Duration Informed Attention Network Based Singing Voice Conversion System. | Liqiang Zhang, Chengzhu Yu, Heng Lu, Chao Weng, Chunlei Zhang, Yusong Wu, Xiang Xie, Zijin Li, Dong Yu |
| 2019 | ICASSP | Seq2Seq Attentional Siamese Neural Networks for Text-dependent Speaker Verification. | Yichi Zhang, Meng Yu, Na Li, Chengzhu Yu, Jia Cui, Dong Yu |
| 2019 | ICLR | Unsupervised Speech Recognition via Segmental Empirical Output Distribution Matching. | Chih-Kuan Yeh, Jianshu Chen, Chengzhu Yu, Dong Yu |
| 2019 | Interspeech | The 2019 Inaugural Fearless Steps Challenge: A Giant Leap for Naturalistic Audio. | John H. L. Hansen, Aditya Joglekar, Meena Chandra Shekhar, Vinay Kothapally, Chengzhu Yu, Lakshmish Kaushik, Abhijeet Sangwan |
| 2018 | Interspeech | Fearless Steps: Apollo-11 Corpus Advancements for Speech Technologies from Earth to the Moon. | John H. L. Hansen, Abhijeet Sangwan, Aditya Joglekar, Ahmet Emin Bulut, Lakshmish Kaushik, Chengzhu Yu |
| 2018 | Interspeech | Improving Attention Based Sequence-to-Sequence Models for End-to-End English Conversational Speech Recognition. | Chao Weng, Jia Cui, Guangsen Wang, Jun Wang, Chengzhu Yu, Dan Su, Dong Yu |
| 2018 | Interspeech | A Multistage Training Framework for Acoustic-to-Word Model. | Chengzhu Yu, Chunlei Zhang, Chao Weng, Jia Cui, Dong Yu |
| 2017 | ICASSP | Advances in all-neural speech recognition. | Geoffrey Zweig, Chengzhu Yu, Jasha Droppo, Andreas Stolcke |
| 2017 | Interspeech | UTD-CRSS Systems for 2016 NIST Speaker Recognition Evaluation. | Chunlei Zhang, Fahimeh Bahmaninezhad, Shivesh Ranjan, Chengzhu Yu, Navid Shokouhi, John H. L. Hansen |
| 2016 | ICASSP | Context adaptive deep neural networks for fast acoustic model adaptation in noisy conditions. | Marc Delcroix, Keisuke Kinoshita, Chengzhu Yu, Atsunori Ogawa, Takuya Yoshioka, Tomohiro Nakatani |
| 2016 | ICASSP | Language recognition using deep neural networks with very limited training data. | Shivesh Ranjan, Chengzhu Yu, Chunlei Zhang, Finnian Kelly, John H. L. Hansen |
| 2016 | ICASSP | UTD-CRSS system for the NIST 2015 language recognition i-vector machine learning challenge. | Chengzhu Yu, Chunlei Zhang, Shivesh Ranjan, Qian Zhang, Abhinav Misra, Finnian Kelly, John H. L. Hansen |
| 2016 | Interspeech | Text-Available Speaker Recognition System for Forensic Applications. | Chengzhu Yu, Chunlei Zhang, Finnian Kelly, Abhijeet Sangwan, John H. L. Hansen |
| 2015 | ASRU | The NTT CHiME-3 system: Advances in speech enhancement and recognition for mobile multi-microphone devices. | Takuya Yoshioka, Nobutaka Ito, Marc Delcroix, Atsunori Ogawa, Keisuke Kinoshita, Masakiyo Fujimoto, Chengzhu Yu, Wojciech J. Fabian, Miquel Espi, Takuya Higuchi, Shoko Araki, Tomohiro Nakatani |
| 2015 | Interspeech | Robust i-vector extraction for neural network adaptation in noisy environment. | Chengzhu Yu, Atsunori Ogawa, Marc Delcroix, Takuya Yoshioka, Tomohiro Nakatani, John H. L. Hansen |
| 2015 | Interspeech | I-vector based physical task stress detection with different fusion strategies. | Chunlei Zhang, Gang Liu, Chengzhu Yu, John H. L. Hansen |
| 2014 | ICASSP | Uncertainty propagation in front end factor analysis for noise robust speaker recognition. | Chengzhu Yu, Gang Liu, Seongjun Hahm, John H. L. Hansen |
| 2014 | Interspeech | 'houston, we have a solution': a case study of the analysis of astronaut speech during NASA apollo 11 for long-term speaker modeling. | Chengzhu Yu, John H. L. Hansen, Douglas W. Oard |
| 2014 | Interspeech | Acoustic feature transformation using UBM-based LDA for speaker recognition. | Chengzhu Yu, Gang Liu, John H. L. Hansen |
| 2013 | ICASSP | A new mask-based objective measure for predicting the intelligibility of binary masked speech. | Chengzhu Yu, Kamil K. Wjcicki, Philipos C. Loizou, John H. L. Hansen |
| 2013 | Interspeech | 'houston, we have a solution': using NASA apollo program to advance speech and language processing technology. | Abhijeet Sangwan, Lakshmish Kaushik, Chengzhu Yu, John H. L. Hansen, Douglas W. Oard |