Jianwei Yu
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
59
Venues
6
Active years
2018–2025
Best venue rank
A*
Where they publish
Papers
59 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | AAAI | SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor. | Chenyu Yang, Shuai Wang, Hangting Chen, Jianwei Yu, Wei Tan, Rongzhi Gu, Yaoxun Xu, Yizhi Zhou, Haina Zhu, Haizhou Li |
| 2025 | ASRU | Towards Efficient Speech-Text Jointly Decoding within One Speech Language Model. | Haibin Wu, Yuxuan Hu, Ruchao Fan, Xiaofei Wang, Ken'ichi Kumatani, Bo Ren, Jianwei Yu, Heng Lu, Lijuan Wang, Yao Qian, Jinyu Li |
| 2025 | ICASSP | Preference Alignment Improves Language Model-Based TTS. | Jinchuan Tian, Chunlei Zhang, Jiatong Shi, Hao Zhang, Jianwei Yu, Shinji Watanabe, Dong Yu |
| 2025 | Interspeech | WAKE: Watermarking Audio with Key Enrichment. | Yaoxun Xu, Jianwei Yu, Hangting Chen, Zhiyong Wu, Xixin Wu, Dong Yu, Rongzhi Gu, Yi Luo |
| 2024 | AAAI | SECap: Speech Emotion Captioning with Large Language Model. | Yaoxun Xu, Hangting Chen, Jianwei Yu, Qiaochu Huang, Zhiyong Wu, Shi-Xiong Zhang, Guangzhi Li, Yi Luo, Rongzhi Gu |
| 2024 | ICASSP | Complexity Scaling for Speech Denoising. | Hangting Chen, Jianwei Yu, Chao Weng |
| 2024 | ICASSP | Leveraging in-the-wild Data for Effective Self-supervised Pretraining in Speaker Recognition. | Shuai Wang, Qibing Bai, Qi Liu, Jianwei Yu, Zhengyang Chen, Bing Han, Yanmin Qian, Haizhou Li |
| 2024 | ICASSP | Consistent and Relevant: Rethink the Query Embedding in General Sound Separation. | Yuanyuan Wang, Hangting Chen, Dongchao Yang, Jianwei Yu, Chao Weng, Zhiyong Wu, Helen Meng |
| 2024 | ICASSP | AutoPrep: An Automatic Preprocessing Framework for In-The-Wild Speech Data. | Jianwei Yu, Hangting Chen, Yanyao Bian, Xiang Li, Yi Luo, Jinchuan Tian, Mengyang Liu, Jiayi Jiang, Shuai Wang |
| 2024 | IJCNN | Continuous Target Speech Extraction: Enhancing Personalized Diarization and Extraction on Complex Recordings. | He Zhao, Hangting Chen, Jianwei Yu, Yuehai Wang |
| 2024 | Interspeech | Improved Factorized Neural Transducer Model For Text-only Domain Adaptation. | Junzhe Liu, Jianwei Yu, Xie Chen |
| 2024 | Interspeech | WeSep: A Scalable and Flexible Toolkit Towards Generalizable Target Speaker Extraction. | Shuai Wang, Ke Zhang, Shaoxiong Lin, Junjie Li, Xuefei Wang, Meng Ge, Jianwei Yu, Yanmin Qian, Haizhou Li |
| 2024 | Interspeech | Comparing Discrete and Continuous Space LLMs for Speech Recognition. | Yaoxun Xu, Shi-Xiong Zhang, Jianwei Yu, Zhiyong Wu, Dong Yu |
| 2023 | ICASSP | TSpeech-AI System Description to the 5th Deep Noise Suppression (DNS) Challenge. | Jianwei Yu, Hangting Chen, Yi Luo, Rongzhi Gu, Weihua Li, Chao Weng |
| 2023 | ICASSP | Efficient Monaural Speech Enhancement with Universal Sample Rate Band-Split RNN. | Jianwei Yu, Yi Luo |
| 2023 | ICLR | Bayes Risk CTC: Controllable CTC Alignment in Sequence-to-Sequence Tasks. | Jinchuan Tian, Brian Yan, Jianwei Yu, Chao Weng, Dong Yu, Shinji Watanabe |
| 2023 | Interspeech | FRA-RIR: Fast Random Approximation of the Image-source Method. | Yi Luo, Jianwei Yu |
| 2023 | Interspeech | Ultra Dual-Path Compression For Joint Echo Cancellation And Noise Suppression. | Hangting Chen, Jianwei Yu, Yi Luo, Rongzhi Gu, Weihua Li, Zhuocheng Lu, Chao Weng |
| 2023 | Interspeech | Use of Speech Impairment Severity for Dysarthric Speech Recognition. | Mengzhe Geng, Zengrui Jin, Tianzi Wang, Shujie Hu, Jiajun Deng, Mingyu Cui, Guinan Li, Jianwei Yu, Xurong Xie, Xunying Liu |
| 2023 | Interspeech | On-the-Fly Feature Based Rapid Speaker Adaptation for Dysarthric and Elderly Speech Recognition. | Mengzhe Geng, Xurong Xie, Rongfeng Su, Jianwei Yu, Zengrui Jin, Tianzi Wang, Shujie Hu, Zi Ye, Helen Meng, Xunying Liu |
| 2023 | Interspeech | Bayes Risk Transducer: Transducer with Controllable Alignment Prediction. | Jinchuan Tian, Jianwei Yu, Hangting Chen, Brian Yan, Chao Weng, Dong Yu, Shinji Watanabe |
| 2023 | Interspeech | NoreSpeech: Knowledge Distillation based Conditional Diffusion Model for Noise-robust Expressive TTS. | Dongchao Yang, Songxiang Liu, Helin Wang, Jianwei Yu, Chao Weng, Yuexian Zou |
| 2023 | Interspeech | High Fidelity Speech Enhancement with Band-split RNN. | Jianwei Yu, Hangting Chen, Yi Luo, Rongzhi Gu, Chao Weng |
| 2022 | ICASSP | Audio-Visual Multi-Channel Speech Separation, Dereverberation and Recognition. | Guinan Li, Jianwei Yu, Jiajun Deng, Xunying Liu, Helen Meng |
| 2022 | ICASSP | Consistent Training and Decoding for End-to-End Speech Recognition Using Lattice-Free MMI. | Jinchuan Tian, Jianwei Yu, Chao Weng, Shi-Xiong Zhang, Dan Su, Dong Yu, Yuexian Zou |
| 2022 | ICASSP | Mixed Precision DNN Quantization for Overlapped Speech Separation and Recognition. | Junhao Xu, Jianwei Yu, Xunying Liu, Helen Meng |
| 2022 | ICASSP | Multi-Channel Speaker Diarization Using Spatial Features for Meetings. | Naijun Zheng, Na Li, Jianwei Yu, Chao Weng, Dan Su, Xunying Liu, Helen Meng |
| 2022 | Interspeech | Automatic Prosody Annotation with Pre-Trained Text-Speech Model. | Ziqian Dai, Jianwei Yu, Yan Wang, Nuo Chen, Yanyao Bian, Guangzhi Li, Deng Cai, Dong Yu |
| 2022 | Interspeech | ASR-Robust Natural Language Understanding on ASR-GLUE dataset. | Lingyun Feng, Jianwei Yu, Yan Wang, Songxiang Liu, Deng Cai, Haitao Zheng |
| 2022 | Interspeech | LAE: Language-Aware Encoder for Monolingual and Multilingual ASR. | Jinchuan Tian, Jianwei Yu, Chunlei Zhang, Yuexian Zou, Dong Yu |
| 2022 | Interspeech | Improving Target Sound Extraction with Timestamp Information. | Helin Wang, Dongchao Yang, Chao Weng, Jianwei Yu, Yuexian Zou |
| 2021 | ICASSP | A Comparative Study of Acoustic and Linguistic Features Classification for Alzheimer's Disease Detection. | Jinchao Li, Jianwei Yu, Zi Ye, Simon Wong, Man-Wai Mak, Brian Mak, Xunying Liu, Helen Meng |
| 2021 | ICASSP | Bayesian Transformer Language Models for Speech Recognition. | Boyang Xue, Jianwei Yu, Junhao Xu, Shansong Liu, Shoukang Hu, Zi Ye, Mengzhe Geng, Xunying Liu, Helen Meng |
| 2021 | ICASSP | Mixed Precision Quantization of Transformer Language Models for Speech Recognition. | Junhao Xu, Shoukang Hu, Jianwei Yu, Xunying Liu, Helen Meng |
| 2021 | ICASSP | Development of the Cuhk Elderly Speech Recognition System for Neurocognitive Disorder Detection Using the Dementiabank Corpus. | Zi Ye, Shoukang Hu, Jinchao Li, Xurong Xie, Mengzhe Geng, Jianwei Yu, Junhao Xu, Boyang Xue, Shansong Liu, Xunying Liu, Helen Meng |
| 2021 | ICASSP | A Joint Training Framework of Multi-Look Separator and Speaker Embedding Extractor for Overlapped Speech. | Naijun Zheng, Na Li, Bo Wu, Meng Yu, Jianwei Yu, Chao Weng, Dan Su, Xunying Liu, Helen Meng |
| 2021 | Interspeech | Bayesian Parametric and Architectural Domain Adaptation of LF-MMI Trained TDNNs for Elderly and Dysarthric Speech Recognition. | Jiajun Deng, Fabian Ritter Gutierrez, Shoukang Hu, Mengzhe Geng, Xurong Xie, Zi Ye, Shansong Liu, Jianwei Yu, Xunying Liu, Helen Meng |
| 2021 | Interspeech | Spectro-Temporal Deep Features for Disordered Speech Assessment and Recognition. | Mengzhe Geng, Shansong Liu, Jianwei Yu, Xurong Xie, Shoukang Hu, Zi Ye, Zengrui Jin, Xunying Liu, Helen Meng |
| 2021 | Interspeech | Adversarial Data Augmentation for Disordered Speech Recognition. | Zengrui Jin, Mengzhe Geng, Xurong Xie, Jianwei Yu, Shansong Liu, Xunying Liu, Helen Meng |
| 2021 | Interspeech | TeCANet: Temporal-Contextual Attention Network for Environment-Aware Speech Dereverberation. | Helin Wang, Bo Wu, Lianwu Chen, Meng Yu, Jianwei Yu, Yong Xu, Shi-Xiong Zhang, Chao Weng, Dan Su, Dong Yu |
| 2020 | ICASSP | Adversarial Attacks on GMM I-Vector Based Speaker Verification Systems. | Xu Li, Jinghua Zhong, Xixin Wu, Jianwei Yu, Xunying Liu, Helen Meng |
| 2020 | ICASSP | End-To-End Voice Conversion Via Cross-Modal Knowledge Distillation for Dysarthric Speech Reconstruction. | Disong Wang, Jianwei Yu, Xixin Wu, Songxiang Liu, Lifa Sun, Xunying Liu, Helen Meng |
| 2020 | ICASSP | Low-bit Quantization of Recurrent Neural Network Language Models Using Alternating Direction Methods of Multipliers. | Junhao Xu, Xie Chen, Shoukang Hu, Jianwei Yu, Xunying Liu, Helen Meng |
| 2020 | ICASSP | Audio-Visual Recognition of Overlapped Speech for the LRS2 Dataset. | Jianwei Yu, Shi-Xiong Zhang, Jian Wu, Shahram Ghorbani, Bo Wu, Shiyin Kang, Shansong Liu, Xunying Liu, Helen Meng, Dong Yu |
| 2020 | Interspeech | Investigation of Data Augmentation Techniques for Disordered Speech Recognition. | Mengzhe Geng, Xurong Xie, Shansong Liu, Jianwei Yu, Shoukang Hu, Xunying Liu, Helen Meng |
| 2020 | Interspeech | Exploiting Cross-Domain Visual Feature Generation for Disordered Speech Recognition. | Shansong Liu, Xurong Xie, Jianwei Yu, Shoukang Hu, Mengzhe Geng, Rongfeng Su, Shi-Xiong Zhang, Xunying Liu, Helen Meng |
| 2020 | Interspeech | Audio-Visual Multi-Channel Recognition of Overlapped Speech. | Jianwei Yu, Bo Wu, Rongzhi Gu, Shi-Xiong Zhang, Lianwu Chen, Yong Xu, Meng Yu, Dan Su, Dong Yu, Xunying Liu, Helen Meng |
| 2019 | ICASSP | End-to-end Code-switched TTS with Mix of Monolingual Recordings. | Yuewen Cao, Xixin Wu, Songxiang Liu, Jianwei Yu, Xu Li, Zhiyong Wu, Xunying Liu, Helen Meng |
| 2019 | ICASSP | Bayesian and Gaussian Process Neural Networks for Large Vocabulary Continuous Speech Recognition. | Shoukang Hu, Max W. Y. Lam, Xurong Xie, Shansong Liu, Jianwei Yu, Xixin Wu, Xunying Liu, Helen Meng |
| 2019 | ICASSP | Gaussian Process Lstm Recurrent Neural Network Language Models for Speech Recognition. | Max W. Y. Lam, Xie Chen, Shoukang Hu, Jianwei Yu, Xunying Liu, Helen Meng |
| 2019 | ICASSP | Speech Emotion Recognition Using Capsule Networks. | Xixin Wu, Songxiang Liu, Yuewen Cao, Xu Li, Jianwei Yu, Dongyang Dai, Xi Ma, Shoukang Hu, Zhiyong Wu, Xunying Liu, Helen Meng |
| 2019 | ICASSP | Recurrent Neural Network Language Model Training Using Natural Gradient. | Jianwei Yu, Max W. Y. Lam, Xie Chen, Shoukang Hu, Songxiang Liu, Xixin Wu, Xunying Liu, Helen Meng |
| 2019 | Interspeech | The CUHK Dysarthric Speech Recognition Systems for English and Cantonese. | Shoukang Hu, Shansong Liu, Heng Fai Chang, Mengzhe Geng, Jiani Chen, Lau Wing Chung, To Ka Hei, Jianwei Yu, Ka Ho Wong, Xunying Liu, Helen Meng |
| 2019 | Interspeech | LF-MMI Training of Bayesian and Gaussian Process Time Delay Neural Networks for Speech Recognition. | Shoukang Hu, Xurong Xie, Shansong Liu, Max W. Y. Lam, Jianwei Yu, Xixin Wu, Xunying Liu, Helen Meng |
| 2019 | Interspeech | Exploiting Visual Features Using Bayesian Gated Neural Networks for Disordered Speech Recognition. | Shansong Liu, Shoukang Hu, Yi Wang, Jianwei Yu, Rongfeng Su, Xunying Liu, Helen Meng |
| 2019 | Interspeech | Comparative Study of Parametric and Representation Uncertainty Modeling for Recurrent Neural Network Language Models. | Jianwei Yu, Max W. Y. Lam, Shoukang Hu, Xixin Wu, Xu Li, Yuewen Cao, Xunying Liu, Helen Meng |
| 2018 | ICASSP | Limited-Memory BFGS Optimization of Recurrent Neural Network Language Models for Speech Recognition. | Xunying Liu, Shansong Liu, Jinze Sha, Jianwei Yu, Zhiyuan Xu, Xie Chen, Helen Meng |
| 2018 | Interspeech | Gaussian Process Neural Networks for Speech Recognition. | Max W. Y. Lam, Shoukang Hu, Xurong Xie, Shansong Liu, Jianwei Yu, Rongfeng Su, Xunying Liu, Helen Meng |
| 2018 | Interspeech | Development of the CUHK Dysarthric Speech Recognition System for the UA Speech Corpus. | Jianwei Yu, Xurong Xie, Shansong Liu, Shoukang Hu, Max W. Y. Lam, Xixin Wu, Ka Ho Wong, Xunying Liu, Helen Meng |