Skip to content

Chunlei Zhang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

38

Venues

6

Active years

2010–2025

Best venue rank

A*

Where they publish

Papers

38 indexed papers, newest first.

YearVenueTitleAuthors
2025ASRUContinual Pre-training for Codec-Based Speech LLMs: Balancing Understanding and Generation.Jiatong Shi, Chunlei Zhang, Jinchuan Tian, Junrui Ni, Hao Zhang, Shinji Watanabe, Dong Yu
2025ICASSPPreference Alignment Improves Language Model-Based TTS.Jinchuan Tian, Chunlei Zhang, Jiatong Shi, Hao Zhang, Jianwei Yu, Shinji Watanabe, Dong Yu
2024ACLMake-A-Voice: Revisiting Voice Large Language Models as Scalable Multilingual and Multitask Learners.Rongjie Huang, Chunlei Zhang, Yongqi Wang, Dongchao Yang, Jinchuan Tian, Zhenhui Ye, Luping Liu, Zehan Wang, Ziyue Jiang, Xuankai Chang, Jiatong Shi, Chao Weng, Zhou Zhao, Dong Yu
2024ICASSPuSee: Unified Speech Enhancement And Editing with Conditional Diffusion Models.Muqiao Yang, Chunlei Zhang, Yong Xu, Zhongweiyang Xu, Heming Wang, Bhiksha Raj, Dong Yu
2024InterspeechTokSing: Singing Voice Synthesis based on Discrete Tokens.Yuning Wu, Chunlei Zhang, Jiatong Shi, Yuxun Tang, Shan Yang, Qin Jin
2023ACLProsody-TTS: Improving Prosody with Masked Autoencoder and Conditional Diffusion Model For Expressive Text-to-Speech.Rongjie Huang, Chunlei Zhang, Yi Ren, Zhou Zhao, Dong Yu
2023ASRUNeuralecho: Hybrid of Full-Band and Sub-Band Recurrent Neural Network For Acoustic Echo Cancellation and Speech Enhancement.Meng Yu, Yong Xu, Chunlei Zhang, Shi-Xiong Zhang, Dong Yu
2022ICASSPRobust Disentangled Variational Speech Representation Learning for Zero-Shot Voice Conversion.Jiachen Lian, Chunlei Zhang, Dong Yu
2022ICASSPJoint Modeling of Code-Switched and Monolingual ASR via Conditional Factorization.Brian Yan, Chunlei Zhang, Meng Yu, Shi-Xiong Zhang, Siddharth Dalmia, Dan Berrebbi, Chao Weng, Shinji Watanabe, Dong Yu
2022ICASSPTowards end-to-end Speaker Diarization with Generalized Neural Speaker Clustering.Chunlei Zhang, Jiatong Shi, Chao Weng, Meng Yu, Dong Yu
2022InterspeechTowards Improved Zero-shot Voice Conversion with Conditional DSVAE.Jiachen Lian, Chunlei Zhang, Gopala Krishna Anumanchipalli, Dong Yu
2022InterspeechLAE: Language-Aware Encoder for Monolingual and Multilingual ASR.Jinchuan Tian, Jianwei Yu, Chunlei Zhang, Yuexian Zou, Dong Yu
2021ICASSPImproving RNN Transducer with Target Speaker Extraction and Neural Uncertainty Estimation.Jiatong Shi, Chunlei Zhang, Chao Weng, Shinji Watanabe, Meng Yu, Dong Yu
2021ICASSPSelf-Supervised Text-Independent Speaker Verification Using Prototypical Momentum Contrastive Learning.Wei Xia, Chunlei Zhang, Chao Weng, Meng Yu, Dong Yu
2021ICASSPTowards Robust Speaker Verification with Target Speaker Enhancement.Chunlei Zhang, Meng Yu, Chao Weng, Dong Yu
2021InterspeechMetricNet: Towards Improved Modeling For Non-Intrusive Speech Quality Assessment.Meng Yu, Chunlei Zhang, Yong Xu, Shi-Xiong Zhang, Dong Yu
2020ICASSPSpeaker-Aware Target Speaker Enhancement by Jointly Learning with Speaker Embedding Extraction.Xuan Ji, Meng Yu, Chunlei Zhang, Dan Su, Tao Yu, Xiaoyu Liu, Dong Yu
2020InterspeechMinimum Bayes Risk Training of RNN-Transducer for End-to-End Speech Recognition.Chao Weng, Chengzhu Yu, Jia Cui, Chunlei Zhang, Dong Yu
2020InterspeechDurIAN-SC: Duration Informed Attention Network Based Singing Voice Conversion System.Liqiang Zhang, Chengzhu Yu, Heng Lu, Chao Weng, Chunlei Zhang, Yusong Wu, Xiang Xie, Zijin Li, Dong Yu
2019ASRUSyllable-Dependent Discriminative Learning for Small Footprint Text-Dependent Speaker Verification.Junyi Peng, Yuexian Zou, Na Li, Deyi Tuo, Dan Su, Meng Yu, Chunlei Zhang, Dong Yu
2019ICASSPUTD-CRSS Systems for 2018 NIST Speaker Recognition Evaluation.Chunlei Zhang, Fahimeh Bahmaninezhad, Shivesh Ranjan, Harishchandra Dubey, Wei Xia, John H. L. Hansen
2019ICASSPSemi-supervised Learning with Generative Adversarial Networks for Arabic Dialect Identification.Chunlei Zhang, Qian Zhang, John H. L. Hansen
2019InterspeechI4U Submission to NIST SRE 2018: Leveraging from a Decade of Shared Experiences.Kong Aik Lee, Ville Hautamki, Tomi H. Kinnunen, Hitoshi Yamamoto, Koji Okabe, Ville Vestman, Jing Huang, Guohong Ding, Hanwu Sun, Anthony Larcher, Rohan Kumar Das, Haizhou Li, Mickael Rouvier, Pierre-Michel Bousquet, Wei Rao, Qing Wang, Chunlei Zhang, Fahimeh Bahmaninezhad, Hctor Delgado, Massimiliano Todisco
2018InterspeechA Multistage Training Framework for Acoustic-to-Word Model.Chengzhu Yu, Chunlei Zhang, Chao Weng, Jia Cui, Dong Yu
2017ASRUUTD-CRSS submission for MGB-3 Arabic dialect identification: Front-end and back-end advancements on broadcast speech.Ahmet Emin Bulut, Qian Zhang, Chunlei Zhang, Fahimeh Bahmaninezhad, John H. L. Hansen
2017ASRUEnd-to-end text-independent speaker verification with flexibility in utterance duration.Chunlei Zhang, Kazuhito Koishida
2017ICASSPA study of speaker verification performance with expressive speech.Srinivas Parthasarathy, Chunlei Zhang, John H. L. Hansen, Carlos Busso
2017InterspeechThe I4U Mega Fusion and Collaboration for NIST Speaker Recognition Evaluation 2016.Kong-Aik Lee, Ville Hautamki, Tomi Kinnunen, Anthony Larcher, Chunlei Zhang, Andreas Nautsch, Themos Stafylakis, Gang Liu, Mickal Rouvier, Wei Rao, Federico Alegre, J. Ma, Man-Wai Mak, Achintya Kumar Sarkar, Hctor Delgado, Rahim Saeidi, Hagai Aronowitz, Aleksandr Sizov, Hanwu Sun, Trung Hieu Nguyen, Guangsen Wang, Bin Ma, Ville Vestman, Md. Sahidullah, M. Halonen, Anssi Kanervisto, Gal Le Lan, Fahimeh Bahmaninezhad, Sergey Isadskiy, Christian Rathgeb, Christoph Busch, Georgios Tzimiropoulos, Q. Qian, Z. Wang, Q. Zhao, T. Wang, H. Li, J. Xue, S. Zhu, R. Jin, T. Zhao, Pierre-Michel Bousquet, Moez Ajili, Waad Ben Kheder, Driss Matrouf, Zhi Hao Lim, Chenglin Xu, Haihua Xu, Xiong Xiao, Eng Siong Chng, Benoit G. B. Fauve, Kaavya Sriskandaraja, Vidhyasaharan Sethu, W. W. Lin, Dennis Alexander Lehmann Thomsen, Zheng-Hua Tan, Massimiliano Todisco, Nicholas W. D. Evans, Haizhou Li, John H. L. Hansen, Jean-Franois Bonastre, Eliathamby Ambikairajah
2017InterspeechUTD-CRSS Systems for 2016 NIST Speaker Recognition Evaluation.Chunlei Zhang, Fahimeh Bahmaninezhad, Shivesh Ranjan, Chengzhu Yu, Navid Shokouhi, John H. L. Hansen
2017InterspeechEnd-to-End Text-Independent Speaker Verification with Triplet Loss on Short Utterances.Chunlei Zhang, Kazuhito Koishida
2016ICASSPLanguage recognition using deep neural networks with very limited training data.Shivesh Ranjan, Chengzhu Yu, Chunlei Zhang, Finnian Kelly, John H. L. Hansen
2016ICASSPUTD-CRSS system for the NIST 2015 language recognition i-vector machine learning challenge.Chengzhu Yu, Chunlei Zhang, Shivesh Ranjan, Qian Zhang, Abhinav Misra, Finnian Kelly, John H. L. Hansen
2016ICASSPJoint information from nonlinear and linear features for spoofing detection: An i-vector/DNN based approach.Chunlei Zhang, Shivesh Ranjan, Mahesh Kumar Nandwana, Qian Zhang, Abhinav Misra, Gang Liu, Finnian Kelly, John H. L. Hansen
2016InterspeechText-Available Speaker Recognition System for Forensic Applications.Chengzhu Yu, Chunlei Zhang, Finnian Kelly, Abhijeet Sangwan, John H. L. Hansen
2015GLOBECOMNonlinear Quantum Network Coding with Classical Communication Resource.Tao Shang, Chunlei Zhang, Ke Li, Jianwei Liu
2015InterspeechAnti-spoofing system: an investigation of measures to detect synthetic and human speech.Abhinav Misra, Shivesh Ranjan, Chunlei Zhang, John H. L. Hansen
2015InterspeechI-vector based physical task stress detection with different fusion strategies.Chunlei Zhang, Gang Liu, Chengzhu Yu, John H. L. Hansen
2010ICNCApplication of fuzzy excessive criterion model to determine source of inrush water in Xieqiao mine.Jiazhong Qian, Chunlei Zhang, Liangcheng Fang, Zhiqiang Gao, Lulu Wang