| 2025 | ICASSP | HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution. | Shengkui Zhao, Kun Zhou, Zexu Pan, Yukun Ma, Chong Zhang, Bin Ma |
| 2025 | ICASSP | Conditional Latent Diffusion-Based Speech Enhancement via Dual Context Learning. | Shengkui Zhao, Zexu Pan, Kun Zhou, Yukun Ma, Chong Zhang, Bin Ma |
| 2025 | Interspeech | Online Audio-Visual Autoregressive Speaker Extraction. | Zexu Pan, Wupeng Wang, Shengkui Zhao, Chong Zhang, Kun Zhou, Yukun Ma, Bin Ma |
| 2025 | Interspeech | Plug-and-Play Co-Occurring Face Attention for Robust Audio-Visual Speaker Extraction. | Zexu Pan, Shengkui Zhao, Tingting Wang, Kun Zhou, Yukun Ma, Chong Zhang, Bin Ma |
| 2025 | Interspeech | ClearerVoice-Studio: Bridging Advanced Speech Processing Research and Practical Deployment. | Shengkui Zhao, Zexu Pan, Bin Ma |
| 2024 | ICASSP | Are Soft Prompts Good Zero-Shot Learners for Speech Recognition? | Dianwen Ng, Chong Zhang, Ruixi Zhang, Yukun Ma, Fabian Ritter Gutierrez, Trung Hieu Nguyen, Chongjia Ni, Shengkui Zhao, Eng Siong Chng, Bin Ma |
| 2024 | ICASSP | SPGM: Prioritizing Local Features for Enhanced Speech Separation Performance. | Jia Qi Yip, Shengkui Zhao, Yukun Ma, Chongjia Ni, Chong Zhang, Hao Wang, Trung Hieu Nguyen, Kun Zhou, Dianwen Ng, Eng Siong Chng, Bin Ma |
| 2024 | ICASSP | MossFormer2: Combining Transformer and RNN-Free Recurrent Network for Enhanced Time-Domain Monaural Speech Separation. | Shengkui Zhao, Yukun Ma, Chongjia Ni, Chong Zhang, Hao Wang, Trung Hieu Nguyen, Kun Zhou, Jia Qi Yip, Dianwen Ng, Bin Ma |
| 2024 | Interspeech | Phonetic Enhanced Language Modeling for Text-to-Speech Synthesis. | Kun Zhou, Shengkui Zhao, Yukun Ma, Chong Zhang, Hao Wang, Dianwen Ng, Chongjia Ni, Trung Hieu Nguyen, Jia Qi Yip, Bin Ma |
| 2024 | Interspeech | Towards Audio Codec-based Speech Separation. | Jia Qi Yip, Shengkui Zhao, Dianwen Ng, Eng Siong Chng, Bin Ma |
| 2023 | ICASSP | D2Former: A Fully Complex Dual-Path Dual-Decoder Conformer Network Using Joint Complex Masking and Complex Spectral Mapping for Monaural Speech Enhancement. | Shengkui Zhao, Bin Ma |
| 2023 | ICASSP | MossFormer: Pushing the Performance Limit of Monaural Speech Separation Using Gated Single-Head Transformer with Convolution-Augmented Joint Self-Attentions. | Shengkui Zhao, Bin Ma |
| 2023 | Interspeech | Adapter-tuning with Effective Token-dependent Representation Shift for Automatic Speech Recognition. | Dianwen Ng, Chong Zhang, Ruixi Zhang, Yukun Ma, Trung Hieu Nguyen, Chongjia Ni, Shengkui Zhao, Qian Chen, Wen Wang, Eng Siong Chng, Bin Ma |
| 2023 | Interspeech | ACA-Net: Towards Lightweight Speaker Verification using Asymmetric Cross Attention. | Jia Qi Yip, Duc-Tuan Truong, Dianwen Ng, Chong Zhang, Yukun Ma, Trung Hieu Nguyen, Chongjia Ni, Shengkui Zhao, Eng Siong Chng, Bin Ma |
| 2022 | ICASSP | End-to-End Complex-Valued Multidilated Convolutional Neural Network for Joint Acoustic Echo Cancellation and Noise Suppression. | Karn N. Watcharasupat, Thi Ngoc Tho Nguyen, Woon-Seng Gan, Shengkui Zhao, Bin Ma |
| 2022 | ICASSP | FRCRN: Boosting Feature Representation Using Frequency Recurrence for Monaural Speech Enhancement. | Shengkui Zhao, Bin Ma, Karn N. Watcharasupat, Woon-Seng Gan |
| 2021 | ICASSP | Monaural Speech Enhancement with Complex Convolutional Block Attention Module and Joint Time Frequency Losses. | Shengkui Zhao, Trung Hieu Nguyen, Bin Ma |
| 2021 | ICASSP | Towards Natural and Controllable Cross-Lingual Voice Conversion Based on Neural TTS Model and Phonetic Posteriorgram. | Shengkui Zhao, Hao Wang, Trung Hieu Nguyen, Bin Ma |
| 2020 | Interspeech | Towards Natural Bilingual and Code-Switched Speech Synthesis Based on Mix of Monolingual Recordings and Cross-Lingual Voice Conversion. | Shengkui Zhao, Trung Hieu Nguyen, Hao Wang, Bin Ma |
| 2019 | Interspeech | Multi-Task Multi-Network Joint-Learning of Deep Residual Networks and Cycle-Consistency Generative Adversarial Networks for Robust Speech Recognition. | Shengkui Zhao, Chongjia Ni, Rong Tong, Bin Ma |
| 2019 | Interspeech | Fast Learning for Non-Parallel Many-to-Many Voice Conversion with Residual Star Generative Adversarial Networks. | Shengkui Zhao, Trung Hieu Nguyen, Hao Wang, Bin Ma |
| 2017 | ICASSP | A novel sparse model for multi-source localization using distributed microphone array. | Thi Ngoc Tho Nguyen, Cagdas Tuna, Shengkui Zhao, Douglas L. Jones |
| 2017 | ICASSP | On time-frequency mask estimation for MVDR beamforming with application in robust speech recognition. | Xiong Xiao, Shengkui Zhao, Douglas L. Jones, Eng Siong Chng, Haizhou Li |
| 2016 | ICASSP | An expectation-maximization eigenvector clustering approach to direction of arrival estimation of multiple speech sources. | Xiong Xiao, Shengkui Zhao, Thi Ngoc Tho Nguyen, Douglas L. Jones, Eng Siong Chng, Haizhou Li |
| 2016 | ICASSP | Large region acoustic source mapping: A generalized sparse constrained deconvolution approach. | Shengkui Zhao, Cagdas Tuna, Thi Ngoc Tho Nguyen, Douglas L. Jones |
| 2015 | ASRU | Robust speech recognition using beamforming with adaptive microphone gains and multichannel noise reduction. | Shengkui Zhao, Xiong Xiao, Zhaofeng Zhang, Thi Ngoc Tho Nguyen, Xionghu Zhong, Bo Ren, Longbiao Wang, Douglas L. Jones, Engsiong Chng, Haizhou Li |
| 2015 | ICASSP | A learning-based approach to direction of arrival estimation in noisy and reverberant environments. | Xiong Xiao, Shengkui Zhao, Xionghu Zhong, Douglas L. Jones, Engsiong Chng, Haizhou Li |
| 2015 | ICASSP | Large region acoustic source mapping using movable arrays. | Shengkui Zhao, Thi Ngoc Tho Nguyen, Douglas L. Jones |
| 2015 | Interspeech | Learning to estimate reverberation time in noisy and reverberant rooms. | Xiong Xiao, Shengkui Zhao, Xionghu Zhong, Douglas L. Jones, Engsiong Chng, Haizhou Li |
| 2014 | ICASSP | Robust DOA estimation of multiple speech sources. | Nguyen Thi Ngoc Tho, Shengkui Zhao, Douglas L. Jones |
| 2014 | Interspeech | A new auxiliary-vector algorithm with conjugate orthogonality for speech enhancement. | Shengkui Zhao, Douglas L. Jones |
| 2012 | DATE | Real-time implementation and performance optimization of 3D sound localization on GPUs. | Yun Liang, Zheng Cui, Shengkui Zhao, Kyle Rupnow, Yihao Zhang, Douglas L. Jones, Deming Chen |
| 2012 | Interspeech | A Fast-Converging Adaptive Frequency-Domain MVDR Beamformer for Speech Enhancement. | Shengkui Zhao, Douglas L. Jones |
| 2010 | ISCAS | Nonlinear image restoration using recurrent radial basis function network. | Shengkui Zhao, Jianfei Cai, Zhihong Man |
| 2006 | ICARCV | Sliding Mode Control of Fuzzy Dynamic Systems. | Suiyang Khoo, Zhihong Man, Shengkui Zhao |
| 2006 | ICARCV | Modified LMS and NLMS Algorithms with a New Variable Step Size. | Shengkui Zhao, Zhihong Man, Suiyang Khoo |