Skip to content

Jianwei Yu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

59

Venues

6

Active years

2018–2025

Best venue rank

A*

Where they publish

Papers

59 indexed papers, newest first.

YearVenueTitleAuthors
2025AAAISongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor.Chenyu Yang, Shuai Wang, Hangting Chen, Jianwei Yu, Wei Tan, Rongzhi Gu, Yaoxun Xu, Yizhi Zhou, Haina Zhu, Haizhou Li
2025ASRUTowards Efficient Speech-Text Jointly Decoding within One Speech Language Model.Haibin Wu, Yuxuan Hu, Ruchao Fan, Xiaofei Wang, Ken'ichi Kumatani, Bo Ren, Jianwei Yu, Heng Lu, Lijuan Wang, Yao Qian, Jinyu Li
2025ICASSPPreference Alignment Improves Language Model-Based TTS.Jinchuan Tian, Chunlei Zhang, Jiatong Shi, Hao Zhang, Jianwei Yu, Shinji Watanabe, Dong Yu
2025InterspeechWAKE: Watermarking Audio with Key Enrichment.Yaoxun Xu, Jianwei Yu, Hangting Chen, Zhiyong Wu, Xixin Wu, Dong Yu, Rongzhi Gu, Yi Luo
2024AAAISECap: Speech Emotion Captioning with Large Language Model.Yaoxun Xu, Hangting Chen, Jianwei Yu, Qiaochu Huang, Zhiyong Wu, Shi-Xiong Zhang, Guangzhi Li, Yi Luo, Rongzhi Gu
2024ICASSPComplexity Scaling for Speech Denoising.Hangting Chen, Jianwei Yu, Chao Weng
2024ICASSPLeveraging in-the-wild Data for Effective Self-supervised Pretraining in Speaker Recognition.Shuai Wang, Qibing Bai, Qi Liu, Jianwei Yu, Zhengyang Chen, Bing Han, Yanmin Qian, Haizhou Li
2024ICASSPConsistent and Relevant: Rethink the Query Embedding in General Sound Separation.Yuanyuan Wang, Hangting Chen, Dongchao Yang, Jianwei Yu, Chao Weng, Zhiyong Wu, Helen Meng
2024ICASSPAutoPrep: An Automatic Preprocessing Framework for In-The-Wild Speech Data.Jianwei Yu, Hangting Chen, Yanyao Bian, Xiang Li, Yi Luo, Jinchuan Tian, Mengyang Liu, Jiayi Jiang, Shuai Wang
2024IJCNNContinuous Target Speech Extraction: Enhancing Personalized Diarization and Extraction on Complex Recordings.He Zhao, Hangting Chen, Jianwei Yu, Yuehai Wang
2024InterspeechImproved Factorized Neural Transducer Model For Text-only Domain Adaptation.Junzhe Liu, Jianwei Yu, Xie Chen
2024InterspeechWeSep: A Scalable and Flexible Toolkit Towards Generalizable Target Speaker Extraction.Shuai Wang, Ke Zhang, Shaoxiong Lin, Junjie Li, Xuefei Wang, Meng Ge, Jianwei Yu, Yanmin Qian, Haizhou Li
2024InterspeechComparing Discrete and Continuous Space LLMs for Speech Recognition.Yaoxun Xu, Shi-Xiong Zhang, Jianwei Yu, Zhiyong Wu, Dong Yu
2023ICASSPTSpeech-AI System Description to the 5th Deep Noise Suppression (DNS) Challenge.Jianwei Yu, Hangting Chen, Yi Luo, Rongzhi Gu, Weihua Li, Chao Weng
2023ICASSPEfficient Monaural Speech Enhancement with Universal Sample Rate Band-Split RNN.Jianwei Yu, Yi Luo
2023ICLRBayes Risk CTC: Controllable CTC Alignment in Sequence-to-Sequence Tasks.Jinchuan Tian, Brian Yan, Jianwei Yu, Chao Weng, Dong Yu, Shinji Watanabe
2023InterspeechFRA-RIR: Fast Random Approximation of the Image-source Method.Yi Luo, Jianwei Yu
2023InterspeechUltra Dual-Path Compression For Joint Echo Cancellation And Noise Suppression.Hangting Chen, Jianwei Yu, Yi Luo, Rongzhi Gu, Weihua Li, Zhuocheng Lu, Chao Weng
2023InterspeechUse of Speech Impairment Severity for Dysarthric Speech Recognition.Mengzhe Geng, Zengrui Jin, Tianzi Wang, Shujie Hu, Jiajun Deng, Mingyu Cui, Guinan Li, Jianwei Yu, Xurong Xie, Xunying Liu
2023InterspeechOn-the-Fly Feature Based Rapid Speaker Adaptation for Dysarthric and Elderly Speech Recognition.Mengzhe Geng, Xurong Xie, Rongfeng Su, Jianwei Yu, Zengrui Jin, Tianzi Wang, Shujie Hu, Zi Ye, Helen Meng, Xunying Liu
2023InterspeechBayes Risk Transducer: Transducer with Controllable Alignment Prediction.Jinchuan Tian, Jianwei Yu, Hangting Chen, Brian Yan, Chao Weng, Dong Yu, Shinji Watanabe
2023InterspeechNoreSpeech: Knowledge Distillation based Conditional Diffusion Model for Noise-robust Expressive TTS.Dongchao Yang, Songxiang Liu, Helin Wang, Jianwei Yu, Chao Weng, Yuexian Zou
2023InterspeechHigh Fidelity Speech Enhancement with Band-split RNN.Jianwei Yu, Hangting Chen, Yi Luo, Rongzhi Gu, Chao Weng
2022ICASSPAudio-Visual Multi-Channel Speech Separation, Dereverberation and Recognition.Guinan Li, Jianwei Yu, Jiajun Deng, Xunying Liu, Helen Meng
2022ICASSPConsistent Training and Decoding for End-to-End Speech Recognition Using Lattice-Free MMI.Jinchuan Tian, Jianwei Yu, Chao Weng, Shi-Xiong Zhang, Dan Su, Dong Yu, Yuexian Zou
2022ICASSPMixed Precision DNN Quantization for Overlapped Speech Separation and Recognition.Junhao Xu, Jianwei Yu, Xunying Liu, Helen Meng
2022ICASSPMulti-Channel Speaker Diarization Using Spatial Features for Meetings.Naijun Zheng, Na Li, Jianwei Yu, Chao Weng, Dan Su, Xunying Liu, Helen Meng
2022InterspeechAutomatic Prosody Annotation with Pre-Trained Text-Speech Model.Ziqian Dai, Jianwei Yu, Yan Wang, Nuo Chen, Yanyao Bian, Guangzhi Li, Deng Cai, Dong Yu
2022InterspeechASR-Robust Natural Language Understanding on ASR-GLUE dataset.Lingyun Feng, Jianwei Yu, Yan Wang, Songxiang Liu, Deng Cai, Haitao Zheng
2022InterspeechLAE: Language-Aware Encoder for Monolingual and Multilingual ASR.Jinchuan Tian, Jianwei Yu, Chunlei Zhang, Yuexian Zou, Dong Yu
2022InterspeechImproving Target Sound Extraction with Timestamp Information.Helin Wang, Dongchao Yang, Chao Weng, Jianwei Yu, Yuexian Zou
2021ICASSPA Comparative Study of Acoustic and Linguistic Features Classification for Alzheimer's Disease Detection.Jinchao Li, Jianwei Yu, Zi Ye, Simon Wong, Man-Wai Mak, Brian Mak, Xunying Liu, Helen Meng
2021ICASSPBayesian Transformer Language Models for Speech Recognition.Boyang Xue, Jianwei Yu, Junhao Xu, Shansong Liu, Shoukang Hu, Zi Ye, Mengzhe Geng, Xunying Liu, Helen Meng
2021ICASSPMixed Precision Quantization of Transformer Language Models for Speech Recognition.Junhao Xu, Shoukang Hu, Jianwei Yu, Xunying Liu, Helen Meng
2021ICASSPDevelopment of the Cuhk Elderly Speech Recognition System for Neurocognitive Disorder Detection Using the Dementiabank Corpus.Zi Ye, Shoukang Hu, Jinchao Li, Xurong Xie, Mengzhe Geng, Jianwei Yu, Junhao Xu, Boyang Xue, Shansong Liu, Xunying Liu, Helen Meng
2021ICASSPA Joint Training Framework of Multi-Look Separator and Speaker Embedding Extractor for Overlapped Speech.Naijun Zheng, Na Li, Bo Wu, Meng Yu, Jianwei Yu, Chao Weng, Dan Su, Xunying Liu, Helen Meng
2021InterspeechBayesian Parametric and Architectural Domain Adaptation of LF-MMI Trained TDNNs for Elderly and Dysarthric Speech Recognition.Jiajun Deng, Fabian Ritter Gutierrez, Shoukang Hu, Mengzhe Geng, Xurong Xie, Zi Ye, Shansong Liu, Jianwei Yu, Xunying Liu, Helen Meng
2021InterspeechSpectro-Temporal Deep Features for Disordered Speech Assessment and Recognition.Mengzhe Geng, Shansong Liu, Jianwei Yu, Xurong Xie, Shoukang Hu, Zi Ye, Zengrui Jin, Xunying Liu, Helen Meng
2021InterspeechAdversarial Data Augmentation for Disordered Speech Recognition.Zengrui Jin, Mengzhe Geng, Xurong Xie, Jianwei Yu, Shansong Liu, Xunying Liu, Helen Meng
2021InterspeechTeCANet: Temporal-Contextual Attention Network for Environment-Aware Speech Dereverberation.Helin Wang, Bo Wu, Lianwu Chen, Meng Yu, Jianwei Yu, Yong Xu, Shi-Xiong Zhang, Chao Weng, Dan Su, Dong Yu
2020ICASSPAdversarial Attacks on GMM I-Vector Based Speaker Verification Systems.Xu Li, Jinghua Zhong, Xixin Wu, Jianwei Yu, Xunying Liu, Helen Meng
2020ICASSPEnd-To-End Voice Conversion Via Cross-Modal Knowledge Distillation for Dysarthric Speech Reconstruction.Disong Wang, Jianwei Yu, Xixin Wu, Songxiang Liu, Lifa Sun, Xunying Liu, Helen Meng
2020ICASSPLow-bit Quantization of Recurrent Neural Network Language Models Using Alternating Direction Methods of Multipliers.Junhao Xu, Xie Chen, Shoukang Hu, Jianwei Yu, Xunying Liu, Helen Meng
2020ICASSPAudio-Visual Recognition of Overlapped Speech for the LRS2 Dataset.Jianwei Yu, Shi-Xiong Zhang, Jian Wu, Shahram Ghorbani, Bo Wu, Shiyin Kang, Shansong Liu, Xunying Liu, Helen Meng, Dong Yu
2020InterspeechInvestigation of Data Augmentation Techniques for Disordered Speech Recognition.Mengzhe Geng, Xurong Xie, Shansong Liu, Jianwei Yu, Shoukang Hu, Xunying Liu, Helen Meng
2020InterspeechExploiting Cross-Domain Visual Feature Generation for Disordered Speech Recognition.Shansong Liu, Xurong Xie, Jianwei Yu, Shoukang Hu, Mengzhe Geng, Rongfeng Su, Shi-Xiong Zhang, Xunying Liu, Helen Meng
2020InterspeechAudio-Visual Multi-Channel Recognition of Overlapped Speech.Jianwei Yu, Bo Wu, Rongzhi Gu, Shi-Xiong Zhang, Lianwu Chen, Yong Xu, Meng Yu, Dan Su, Dong Yu, Xunying Liu, Helen Meng
2019ICASSPEnd-to-end Code-switched TTS with Mix of Monolingual Recordings.Yuewen Cao, Xixin Wu, Songxiang Liu, Jianwei Yu, Xu Li, Zhiyong Wu, Xunying Liu, Helen Meng
2019ICASSPBayesian and Gaussian Process Neural Networks for Large Vocabulary Continuous Speech Recognition.Shoukang Hu, Max W. Y. Lam, Xurong Xie, Shansong Liu, Jianwei Yu, Xixin Wu, Xunying Liu, Helen Meng
2019ICASSPGaussian Process Lstm Recurrent Neural Network Language Models for Speech Recognition.Max W. Y. Lam, Xie Chen, Shoukang Hu, Jianwei Yu, Xunying Liu, Helen Meng
2019ICASSPSpeech Emotion Recognition Using Capsule Networks.Xixin Wu, Songxiang Liu, Yuewen Cao, Xu Li, Jianwei Yu, Dongyang Dai, Xi Ma, Shoukang Hu, Zhiyong Wu, Xunying Liu, Helen Meng
2019ICASSPRecurrent Neural Network Language Model Training Using Natural Gradient.Jianwei Yu, Max W. Y. Lam, Xie Chen, Shoukang Hu, Songxiang Liu, Xixin Wu, Xunying Liu, Helen Meng
2019InterspeechThe CUHK Dysarthric Speech Recognition Systems for English and Cantonese.Shoukang Hu, Shansong Liu, Heng Fai Chang, Mengzhe Geng, Jiani Chen, Lau Wing Chung, To Ka Hei, Jianwei Yu, Ka Ho Wong, Xunying Liu, Helen Meng
2019InterspeechLF-MMI Training of Bayesian and Gaussian Process Time Delay Neural Networks for Speech Recognition.Shoukang Hu, Xurong Xie, Shansong Liu, Max W. Y. Lam, Jianwei Yu, Xixin Wu, Xunying Liu, Helen Meng
2019InterspeechExploiting Visual Features Using Bayesian Gated Neural Networks for Disordered Speech Recognition.Shansong Liu, Shoukang Hu, Yi Wang, Jianwei Yu, Rongfeng Su, Xunying Liu, Helen Meng
2019InterspeechComparative Study of Parametric and Representation Uncertainty Modeling for Recurrent Neural Network Language Models.Jianwei Yu, Max W. Y. Lam, Shoukang Hu, Xixin Wu, Xu Li, Yuewen Cao, Xunying Liu, Helen Meng
2018ICASSPLimited-Memory BFGS Optimization of Recurrent Neural Network Language Models for Speech Recognition.Xunying Liu, Shansong Liu, Jinze Sha, Jianwei Yu, Zhiyuan Xu, Xie Chen, Helen Meng
2018InterspeechGaussian Process Neural Networks for Speech Recognition.Max W. Y. Lam, Shoukang Hu, Xurong Xie, Shansong Liu, Jianwei Yu, Rongfeng Su, Xunying Liu, Helen Meng
2018InterspeechDevelopment of the CUHK Dysarthric Speech Recognition System for the UA Speech Corpus.Jianwei Yu, Xurong Xie, Shansong Liu, Shoukang Hu, Max W. Y. Lam, Xixin Wu, Ka Ho Wong, Xunying Liu, Helen Meng