| 2025 | ICASSP | Contextualization of ASR with LLM using phonetic retrieval-based augmentation. | Zhihong Lei, Xingyu Na, Mingbin Xu, Ernest Pusateri, Christophe Van Gysel, Yuanyuan Zhang, Shiyi Han, Zhen Huang |
| 2024 | Interspeech | Enhancing CTC-based speech recognition with diverse modeling units. | Shiyi Han, Mingbin Xu, Zhihong Lei, Zhen Huang, Xingyu Na |
| 2016 | ICASSP | An empirical exploration of CTC acoustic models. | Yajie Miao, Mohammad Gowayyed, Xingyu Na, Tom Ko, Florian Metze, Alexander Waibel |
| 2016 | Interspeech | Purely Sequence-Trained Neural Networks for ASR Based on Lattice-Free MMI. | Daniel Povey, Vijayaditya Peddinti, Daniel Galvez, Pegah Ghahremani, Vimal Manohar, Xingyu Na, Yiming Wang, Sanjeev Khudanpur |
| 2015 | ASRU | Two-stage ASGD framework for parallel training of DNN acoustic models using Ethernet. | Zhichao Wang, Xingyu Na, Xin Li, Jielin Pan, Yonghong Yan |
| 2014 | ICASSP | Improving voice quality of HMM-based speech synthesis using voice conversion method. | Yishan Jiao, Xiang Xie, Xingyu Na, Ming Tu |
| 2014 | ICPR | Computational Auditory Scene Analysis Based Voice Activity Detection. | Ming Tu, Xiang Xie, Xingyu Na |
| 2013 | Interspeech | Syllable-based pitch encoding for low bit rate speech coding with recognition/synthesis architecture. | Milos Cernak, Xingyu Na, Philip N. Garner |