| 2025 | ICML | Multi-band Frequency Reconstruction for Neural Psychoacoustic Coding. | Dianwen Ng, Kun Zhou, Yi-Wen Chao, Zhiwei Xiong, Bin Ma, Engsiong Chng |
| 2025 | NAACL | DiaSynth: Synthetic Dialogue Generation Framework for Low Resource Dialogue Applications. | Sathya Krishnan Suresh, Mengjun Wu, Tushar Pranav, Engsiong Chng |
| 2024 | ACL | Listen Again and Choose the Right Answer: A New Paradigm for Automatic Speech Recognition with Large Language Models. | Yuchen Hu, Chen Chen, Chengwei Qin, Qiushi Zhu, Engsiong Chng, Ruizhe Li |
| 2024 | ACL | GenTranslate: Large Language Models are Generative Multilingual Speech and Machine Translators. | Yuchen Hu, Chen Chen, Chao-Han Huck Yang, Ruizhe Li, Dong Zhang, Zhehuai Chen, Engsiong Chng |
| 2024 | EMNLP | Speaking in Wavelet Domain: A Simple and Efficient Approach to Speed up Speech Diffusion Model. | Xiangyu Zhang, Daijiao Liu, Hexin Liu, Qiquan Zhang, Hanyu Meng, Leibny Paola Garca-Perera, Engsiong Chng, Lina Yao |
| 2024 | ICLR | It's Never Too Late: Fusing Acoustic Information into Large Language Models for Automatic Speech Recognition. | Chen Chen, Ruizhe Li, Yuchen Hu, Sabato Marco Siniscalchi, Pin-Yu Chen, Engsiong Chng, Chao-Han Huck Yang |
| 2024 | ICLR | Large Language Models are Efficient Learners of Noise-Robust Speech Recognition. | Yuchen Hu, Chen Chen, Chao-Han Huck Yang, Ruizhe Li, Chao Zhang, Pin-Yu Chen, Engsiong Chng |
| 2015 | ASRU | Speech enhancement using beamforming and non negative matrix factorization for robust speech recognition in the CHiME-3 challenge. | Thanh T. Vu, Benjamin Bigot, Engsiong Chng |
| 2015 | ASRU | Robust speech recognition using beamforming with adaptive microphone gains and multichannel noise reduction. | Shengkui Zhao, Xiong Xiao, Zhaofeng Zhang, Thi Ngoc Tho Nguyen, Xionghu Zhong, Bo Ren, Longbiao Wang, Douglas L. Jones, Engsiong Chng, Haizhou Li |
| 2015 | ICASSP | Low-resource keyword search strategies for tamil. | Nancy F. Chen, Chongjia Ni, I-Fan Chen, Sunil Sivadas, Van Tung Pham, Haihua Xu, Xiong Xiao, Tze Siong Lau, Su Jun Leow, Boon Pang Lim, Cheung-Chi Leung, Lei Wang, Chin-Hui Lee, Alvina Goh, Engsiong Chng, Bin Ma, Haizhou Li |
| 2015 | ICASSP | Language-resource independent speech segmentation using cues from a spectrogram image. | Su Jun Leow, Engsiong Chng, Chin-Hui Lee |
| 2015 | ICASSP | Sparse representation for frequency warping based voice conversion. | Xiaohai Tian, Zhizheng Wu, Siu Wa Lee, Nguyen Quy Hy, Engsiong Chng, Minghui Dong |
| 2015 | ICASSP | A learning-based approach to direction of arrival estimation in noisy and reverberant environments. | Xiong Xiao, Shengkui Zhao, Xionghu Zhong, Douglas L. Jones, Engsiong Chng, Haizhou Li |
| 2015 | ICASSP | Language independent query-by-example spoken term detection using N-best phone sequences and partial matching. | Haihua Xu, Peng Yang, Xiong Xiao, Lei Xie, Cheung-Chi Leung, Hongjie Chen, Jia Yu, Hang Lv, Lei Wang, Su Jun Leow, Bin Ma, Engsiong Chng, Haizhou Li |
| 2015 | Interspeech | TDTO language modeling with feedforward neural networks. | Tze Yuang Chong, Rafael E. Banchs, Engsiong Chng, Haizhou Li |
| 2015 | Interspeech | System fusion for high-performance voice conversion. | Xiaohai Tian, Zhizheng Wu, Siu Wa Lee, Nguyen Quy Hy, Minghui Dong, Engsiong Chng |
| 2015 | Interspeech | Spoofing speech detection using high dimensional magnitude and phase features: the NTU approach for ASVspoof 2015 challenge. | Xiong Xiao, Xiaohai Tian, Steven Du, Haihua Xu, Engsiong Chng, Haizhou Li |
| 2015 | Interspeech | Learning to estimate reverberation time in noisy and reverberant rooms. | Xiong Xiao, Shengkui Zhao, Xionghu Zhong, Douglas L. Jones, Engsiong Chng, Haizhou Li |
| 2015 | Interspeech | A comparative study of BNF and DNN multilingual training on cross-lingual low-resource speech recognition. | Haihua Xu, Van Hai Do, Xiong Xiao, Engsiong Chng |
| 2015 | Interspeech | Regularized non-negative matrix factorization using alternating direction method of multipliers and its application to source separation. | Shaofei Zhang, Dong-Yan Huang, Lei Xie, Engsiong Chng, Haizhou Li, Minghui Dong |
| 2014 | FUSION | A Bayesian performance bound for time-delay of arrival based acoustic source tracking in a reverberant environment. | Xionghu Zhong, Wenwu Wang, Syed Mohsen Naqvi, Engsiong Chng |
| 2014 | ICASSP | Improving language modeling by using distance and co-occurrence information of word-pairs and its application to LVCSR. | Tze Yuang Chong, Rafael E. Banchs, Engsiong Chng, Haizhou Li |
| 2014 | ICASSP | A discriminatively trained Hough Transform for frame-level phoneme recognition. | Jonathan William Dennis, Tran Huy Dat, Haizhou Li, Engsiong Chng |
| 2014 | ICASSP | Generalization of temporal filter and linear transformation for robust speech recognition. | Duc Hoang Ha Nguyen, Xiong Xiao, Engsiong Chng, Haizhou Li |
| 2014 | ICASSP | Discriminative score normalization for keyword search decision. | Van Tung Pham, Haihua Xu, Nancy F. Chen, Sunil Sivadas, Boon Pang Lim, Engsiong Chng, Haizhou Li |
| 2014 | ICASSP | Feature compensation using linear combination of speaker and environment dependent correction vectors. | Xiong Xiao, Jinyu Li, Engsiong Chng, Haizhou Li |
| 2014 | Interspeech | A deep neural network approach for sentence boundary detection in broadcast news. | Chenglin Xu, Lei Xie, Guangpu Huang, Xiong Xiao, Engsiong Chng, Haizhou Li |
| 2013 | ACL | Modeling of term-distance and term-occurrence information for improving n-gram language model performance. | Tze Yuang Chong, Rafael E. Banchs, Engsiong Chng, Haizhou Li |
| 2013 | ICASSP | Language diarization for code-switch conversational speech. | Dau-Cheng Lyu, Engsiong Chng, Haizhou Li |
| 2013 | ICASSP | Synthetic speech detection using temporal modulation feature. | Zhizheng Wu, Xiong Xiao, Engsiong Chng, Haizhou Li |
| 2013 | ICASSP | Temporal filter design by minimum KL divergence criterion for robust speech recognition. | Xiong Xiao, Engsiong Chng, Haizhou Li |
| 2013 | Interspeech | Context-dependent phone mapping for LVCSR of under-resourced languages. | Van Hai Do, Xiong Xiao, Engsiong Chng, Haizhou Li |
| 2013 | Interspeech | Vulnerability evaluation of speaker verification under voice conversion spoofing: the effect of text constraints. | Zhizheng Wu, Anthony Larcher, Kong-Aik Lee, Engsiong Chng, Tomi Kinnunen, Haizhou Li |
| 2013 | Interspeech | Exemplar-based unit selection for voice conversion utilizing temporal information. | Zhizheng Wu, Tuomas Virtanen, Tomi Kinnunen, Engsiong Chng, Haizhou Li |
| 2013 | Interspeech | Attribute-based histogram equalization (HEQ) and its adaptation for robust speech recognition. | Xiong Xiao, Engsiong Chng, Haizhou Li |
| 2012 | ICASSP | Vulnerability of speaker verification systems against voice conversion spoofing attacks: The case of telephone speech. | Tomi Kinnunen, Zhizheng Wu, Kong-Aik Lee, Filip Sedlak, Engsiong Chng, Haizhou Li |
| 2012 | ICASSP | A first speech recognition system for Mandarin-English code-switch conversational speech. | Ngoc Thang Vu, Dau-Cheng Lyu, Jochen Weiner, Dominic Telaar, Tim Schlippe, Fabian Blaicher, Engsiong Chng, Tanja Schultz, Haizhou Li |
| 2012 | ICASSP | Joint spectral and temporal normalization of features for robust recognition of noisy and reverberated speech. | Xiong Xiao, Engsiong Chng, Haizhou Li |
| 2012 | ICASSP | Lasso environment model combination for robust speech recognition. | Xiong Xiao, Jinyu Li, Engsiong Chng, Haizhou Li |
| 2012 | Interspeech | Overlapping Sound Event Recognition using Local Spectrogram Features with the Generalised Hough Transform. | Jonathan William Dennis, Tran Huy Dat, Engsiong Chng |
| 2011 | ICASSP | Maximum likelihood adaptation of histogram equalization with constraint for robust speech recognition. | Xiong Xiao, Jinyu Li, Engsiong Chng, Haizhou Li |
| 2010 | EMNLP | Non-Isomorphic Forest Pair Translation. | Hui Zhang, Min Zhang, Haizhou Li, Engsiong Chng |
| 2010 | ICASSP | Error corrective classifier fusion for spoken Language Recognition. | Omid Dehzangi, Bin Ma, Engsiong Chng, Haizhou Li |
| 2010 | ICPR | Framewise Phone Classification Using Weighted Fuzzy Classification Rules. | Omid Dehzangi, Bin Ma, Engsiong Chng, Haizhou Li |
| 2010 | Interspeech | A discriminative performance metric for GMM-UBM speaker identification. | Omid Dehzangi, Bin Ma, Engsiong Chng, Haizhou Li |
| 2010 | Interspeech | SEAME: a Mandarin-English code-switching speech corpus in south-east asia. | Dau-Cheng Lyu, Tien Ping Tan, Engsiong Chng, Haizhou Li |
| 2010 | Interspeech | Selecting phonotactic features for language recognition. | Rong Tong, Bin Ma, Haizhou Li, Engsiong Chng |
| 2010 | Interspeech | Phoneme lattice based texttiling towards multilingual story segmentation. | Xiaoxuan Wang, Lei Xie, Bin Ma, Engsiong Chng, Haizhou Li |
| 2010 | Interspeech | Text-independent F0 transformation with non-parallel data for voice conversion. | Zhizheng Wu, Tomi Kinnunen, Engsiong Chng, Haizhou Li |
| 2009 | ASRU | A study on hidden Markov model's generalization capability for speech recognition. | Xiong Xiao, Jinyu Li, Engsiong Chng, Haizhou Li, Chin-Hui Lee |
| 2009 | Interspeech | Discriminative feature transformation using output coding for speech recognition. | Omid Dehzangi, Bin Ma, Engsiong Chng, Haizhou Li |
| 2009 | Interspeech | Target-aware language models for spoken language recognition. | Rong Tong, Bin Ma, Haizhou Li, Engsiong Chng, Kong-Aik Lee |
| 2008 | ICASSP | Target-oriented phone tokenizers for spoken language recognition. | Rong Tong, Bin Ma, Haizhou Li, Engsiong Chng |
| 2008 | Interspeech | T-test distance and clustering criterion for speaker diarization. | Trung Hieu Nguyen, Engsiong Chng, Haizhou Li |
| 2008 | Interspeech | Target-oriented phone selection from universal phone set for spoken language recognition. | Rong Tong, Bin Ma, Haizhou Li, Engsiong Chng |
| 2007 | ICASSP | Spoken Language Recognition with Relevance Feedback. | Rong Tong, Haizhou Li, Bin Ma, Engsiong Chng, Siu-Yeung Cho |
| 2007 | ICASSP | Normalizing the Speech Modulation Spectrum for Robust Speech Recognition. | Xiong Xiao, Engsiong Chng, Haizhou Li |
| 2007 | Interspeech | Using direction of arrival estimate and acoustic feature information in speaker diarization. | Chin-Wei Eugene Koh, Hanwu Sun, Tin Lay Nwe, Trung Hieu Nguyen, Bin Ma, Engsiong Chng, Haizhou Li, Susanto Rahardja |
| 2007 | Interspeech | Evaluating the temporal structure normalisation technique on the Aurora-4 task. | Xiong Xiao, Engsiong Chng, Haizhou Li |
| 2006 | ICASSP | Integrating Acoustic, Prosodic and Phonotactic Features for Spoken Language Identification. | Rong Tong, Bin Ma, Donglai Zhu, Haizhou Li, Engsiong Chng |
| 2006 | ICPR | Automatic Sports Video Genre Classification using Pseudo-2D-HMM. | Jinjun Wang, Changsheng Xu, Engsiong Chng |
| 2005 | ICASSP | Soccer replay detection using scene transition structure analysis. | Jinjun Wang, Engsiong Chng, Changsheng Xu |
| 1994 | ICASSP | Reducing the computational requirement of the orthogonal least squares algorithm. | Engsiong Chng, Sheng Chen, Bernard Mulgrew |