| 2024 | IJCNN | Human Behavior Modeling in Speech Transcribing Process via Pretrained Speech Recognition Models. | Bao Thang Ta, Minh Khang Pham, Nhat Minh Le, Van Hai Do |
| 2024 | Interspeech | Enhancing Non-Matching Reference Speech Quality Assessment through Dynamic Weight Adaptation. | Bao Thang Ta, Van Hai Do, Huynh Thi Thanh Binh |
| 2024 | Interspeech | Enhancing No-Reference Speech Quality Assessment with Pairwise, Triplet Ranking Losses, and ASR Pretraining. | Bao Thang Ta, Minh Tu Le, Van Hai Do, Huynh Thi Thanh Binh |
| 2023 | Interspeech | LightVoc: An Upsampling-Free GAN Vocoder Based On Conformer And Inverse Short-time Fourier Transform. | Dinh Son Dang, Tung Lam Nguyen, Bao Thang Ta, Tien Thanh Nguyen, Thi Ngoc Anh Nguyen, Dang Linh Le, Nhat Minh Le, Van Hai Do |
| 2023 | Interspeech | Probing Speech Quality Information in ASR Systems. | Bao Thang Ta, Minh Tu Le, Nhat Minh Le, Van Hai Do |
| 2017 | ACSSC | Mismatched crowdsourcing: Mining latent skills to acquire speech transcriptions. | Mark Hasegawa-Johnson, Preethi Jyothi, Wenda Chen, Van Hai Do |
| 2017 | Interspeech | Multi-Task Learning Using Mismatched Transcription for Under-Resourced Speech Recognition. | Van Hai Do, Nancy F. Chen, Boon Pang Lim, Mark Hasegawa-Johnson |
| 2016 | ACIIDS | Improving Efficiency of Sentence Boundary Detection by Feature Selection. | Thi-Nga Ho, Tze Yuang Chong, Van Hai Do, Van Tung Pham, Eng Siong Chng |
| 2016 | ICASSP | Exemplar-inspired strategies for low-resource spoken keyword search in Swahili. | Nancy F. Chen, Van Tung Pham, Haihua Xu, Xiong Xiao, Van Hai Do, Chongjia Ni, I-Fan Chen, Sunil Sivadas, Chin-Hui Lee, Eng Siong Chng, Bin Ma, Haizhou Li |
| 2016 | ICASSP | Approximate search of audio queries by using DTW with phone time boundary and data augmentation. | Haihua Xu, Jingyong Hou, Xiong Xiao, Van Tung Pham, Cheung-Chi Leung, Lei Wang, Van Hai Do, Hang Lv, Lei Xie, Bin Ma, Eng Siong Chng, Haizhou Li |
| 2016 | Interspeech | Analysis of Mismatched Transcriptions Generated by Humans and Machines for Under-Resourced Languages. | Van Hai Do, Nancy F. Chen, Boon Pang Lim, Mark Hasegawa-Johnson |
| 2015 | Interspeech | A comparative study of BNF and DNN multilingual training on cross-lingual low-resource speech recognition. | Haihua Xu, Van Hai Do, Xiong Xiao, Engsiong Chng |
| 2014 | Interspeech | Kernel density-based acoustic model with cross-lingual bottleneck features for resource limited LVCSR. | Van Hai Do, Xiong Xiao, Chng Eng Siong, Haizhou Li |
| 2013 | Interspeech | Context-dependent phone mapping for LVCSR of under-resourced languages. | Van Hai Do, Xiong Xiao, Engsiong Chng, Haizhou Li |
| 2013 | Interspeech | A study on LVCSR and keyword search for tagalog. | Korbinian Riedhammer, Van Hai Do, James Hieronymus |