Skip to content

Shengkui Zhao

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

36

Venues

6

Active years

2006–2025

Best venue rank

Multiconference

Where they publish

Papers

36 indexed papers, newest first.

YearVenueTitleAuthors
2025ICASSPHiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution.Shengkui Zhao, Kun Zhou, Zexu Pan, Yukun Ma, Chong Zhang, Bin Ma
2025ICASSPConditional Latent Diffusion-Based Speech Enhancement via Dual Context Learning.Shengkui Zhao, Zexu Pan, Kun Zhou, Yukun Ma, Chong Zhang, Bin Ma
2025InterspeechOnline Audio-Visual Autoregressive Speaker Extraction.Zexu Pan, Wupeng Wang, Shengkui Zhao, Chong Zhang, Kun Zhou, Yukun Ma, Bin Ma
2025InterspeechPlug-and-Play Co-Occurring Face Attention for Robust Audio-Visual Speaker Extraction.Zexu Pan, Shengkui Zhao, Tingting Wang, Kun Zhou, Yukun Ma, Chong Zhang, Bin Ma
2025InterspeechClearerVoice-Studio: Bridging Advanced Speech Processing Research and Practical Deployment.Shengkui Zhao, Zexu Pan, Bin Ma
2024ICASSPAre Soft Prompts Good Zero-Shot Learners for Speech Recognition?Dianwen Ng, Chong Zhang, Ruixi Zhang, Yukun Ma, Fabian Ritter Gutierrez, Trung Hieu Nguyen, Chongjia Ni, Shengkui Zhao, Eng Siong Chng, Bin Ma
2024ICASSPSPGM: Prioritizing Local Features for Enhanced Speech Separation Performance.Jia Qi Yip, Shengkui Zhao, Yukun Ma, Chongjia Ni, Chong Zhang, Hao Wang, Trung Hieu Nguyen, Kun Zhou, Dianwen Ng, Eng Siong Chng, Bin Ma
2024ICASSPMossFormer2: Combining Transformer and RNN-Free Recurrent Network for Enhanced Time-Domain Monaural Speech Separation.Shengkui Zhao, Yukun Ma, Chongjia Ni, Chong Zhang, Hao Wang, Trung Hieu Nguyen, Kun Zhou, Jia Qi Yip, Dianwen Ng, Bin Ma
2024InterspeechPhonetic Enhanced Language Modeling for Text-to-Speech Synthesis.Kun Zhou, Shengkui Zhao, Yukun Ma, Chong Zhang, Hao Wang, Dianwen Ng, Chongjia Ni, Trung Hieu Nguyen, Jia Qi Yip, Bin Ma
2024InterspeechTowards Audio Codec-based Speech Separation.Jia Qi Yip, Shengkui Zhao, Dianwen Ng, Eng Siong Chng, Bin Ma
2023ICASSPD2Former: A Fully Complex Dual-Path Dual-Decoder Conformer Network Using Joint Complex Masking and Complex Spectral Mapping for Monaural Speech Enhancement.Shengkui Zhao, Bin Ma
2023ICASSPMossFormer: Pushing the Performance Limit of Monaural Speech Separation Using Gated Single-Head Transformer with Convolution-Augmented Joint Self-Attentions.Shengkui Zhao, Bin Ma
2023InterspeechAdapter-tuning with Effective Token-dependent Representation Shift for Automatic Speech Recognition.Dianwen Ng, Chong Zhang, Ruixi Zhang, Yukun Ma, Trung Hieu Nguyen, Chongjia Ni, Shengkui Zhao, Qian Chen, Wen Wang, Eng Siong Chng, Bin Ma
2023InterspeechACA-Net: Towards Lightweight Speaker Verification using Asymmetric Cross Attention.Jia Qi Yip, Duc-Tuan Truong, Dianwen Ng, Chong Zhang, Yukun Ma, Trung Hieu Nguyen, Chongjia Ni, Shengkui Zhao, Eng Siong Chng, Bin Ma
2022ICASSPEnd-to-End Complex-Valued Multidilated Convolutional Neural Network for Joint Acoustic Echo Cancellation and Noise Suppression.Karn N. Watcharasupat, Thi Ngoc Tho Nguyen, Woon-Seng Gan, Shengkui Zhao, Bin Ma
2022ICASSPFRCRN: Boosting Feature Representation Using Frequency Recurrence for Monaural Speech Enhancement.Shengkui Zhao, Bin Ma, Karn N. Watcharasupat, Woon-Seng Gan
2021ICASSPMonaural Speech Enhancement with Complex Convolutional Block Attention Module and Joint Time Frequency Losses.Shengkui Zhao, Trung Hieu Nguyen, Bin Ma
2021ICASSPTowards Natural and Controllable Cross-Lingual Voice Conversion Based on Neural TTS Model and Phonetic Posteriorgram.Shengkui Zhao, Hao Wang, Trung Hieu Nguyen, Bin Ma
2020InterspeechTowards Natural Bilingual and Code-Switched Speech Synthesis Based on Mix of Monolingual Recordings and Cross-Lingual Voice Conversion.Shengkui Zhao, Trung Hieu Nguyen, Hao Wang, Bin Ma
2019InterspeechMulti-Task Multi-Network Joint-Learning of Deep Residual Networks and Cycle-Consistency Generative Adversarial Networks for Robust Speech Recognition.Shengkui Zhao, Chongjia Ni, Rong Tong, Bin Ma
2019InterspeechFast Learning for Non-Parallel Many-to-Many Voice Conversion with Residual Star Generative Adversarial Networks.Shengkui Zhao, Trung Hieu Nguyen, Hao Wang, Bin Ma
2017ICASSPA novel sparse model for multi-source localization using distributed microphone array.Thi Ngoc Tho Nguyen, Cagdas Tuna, Shengkui Zhao, Douglas L. Jones
2017ICASSPOn time-frequency mask estimation for MVDR beamforming with application in robust speech recognition.Xiong Xiao, Shengkui Zhao, Douglas L. Jones, Eng Siong Chng, Haizhou Li
2016ICASSPAn expectation-maximization eigenvector clustering approach to direction of arrival estimation of multiple speech sources.Xiong Xiao, Shengkui Zhao, Thi Ngoc Tho Nguyen, Douglas L. Jones, Eng Siong Chng, Haizhou Li
2016ICASSPLarge region acoustic source mapping: A generalized sparse constrained deconvolution approach.Shengkui Zhao, Cagdas Tuna, Thi Ngoc Tho Nguyen, Douglas L. Jones
2015ASRURobust speech recognition using beamforming with adaptive microphone gains and multichannel noise reduction.Shengkui Zhao, Xiong Xiao, Zhaofeng Zhang, Thi Ngoc Tho Nguyen, Xionghu Zhong, Bo Ren, Longbiao Wang, Douglas L. Jones, Engsiong Chng, Haizhou Li
2015ICASSPA learning-based approach to direction of arrival estimation in noisy and reverberant environments.Xiong Xiao, Shengkui Zhao, Xionghu Zhong, Douglas L. Jones, Engsiong Chng, Haizhou Li
2015ICASSPLarge region acoustic source mapping using movable arrays.Shengkui Zhao, Thi Ngoc Tho Nguyen, Douglas L. Jones
2015InterspeechLearning to estimate reverberation time in noisy and reverberant rooms.Xiong Xiao, Shengkui Zhao, Xionghu Zhong, Douglas L. Jones, Engsiong Chng, Haizhou Li
2014ICASSPRobust DOA estimation of multiple speech sources.Nguyen Thi Ngoc Tho, Shengkui Zhao, Douglas L. Jones
2014InterspeechA new auxiliary-vector algorithm with conjugate orthogonality for speech enhancement.Shengkui Zhao, Douglas L. Jones
2012DATEReal-time implementation and performance optimization of 3D sound localization on GPUs.Yun Liang, Zheng Cui, Shengkui Zhao, Kyle Rupnow, Yihao Zhang, Douglas L. Jones, Deming Chen
2012InterspeechA Fast-Converging Adaptive Frequency-Domain MVDR Beamformer for Speech Enhancement.Shengkui Zhao, Douglas L. Jones
2010ISCASNonlinear image restoration using recurrent radial basis function network.Shengkui Zhao, Jianfei Cai, Zhihong Man
2006ICARCVSliding Mode Control of Fuzzy Dynamic Systems.Suiyang Khoo, Zhihong Man, Shengkui Zhao
2006ICARCVModified LMS and NLMS Algorithms with a New Variable Step Size.Shengkui Zhao, Zhihong Man, Suiyang Khoo