Skip to content

Wen-Chin Huang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

36

Venues

6

Active years

2019–2025

Best venue rank

A*

Where they publish

Papers

36 indexed papers, newest first.

YearVenueTitleAuthors
2025ASRUThe AudioMOS Challenge 2025.Wen-Chin Huang, Hui Wang, Cheng Liu, Yi-Chiao Wu, Andros Tjandra, Wei-Ning Hsu, Erica Cooper, Yong Qin, Tomoki Toda
2025ASRUHighRateMOS: Sampling-Rate Aware Modeling for Speech Quality Assessment.Wenze Ren, Yi-Cheng Lin, Wen-Chin Huang, Ryandhimas E. Zezario, Szu-Wei Fu, Sung-Feng Huang, Erica Cooper, Haibin Wu, Hung-Yu Wei, Hsin-Min Wang, Hung-Yi Lee, Yu Tsao
2025ASRUVERSA-v2: A Modular and Scalable Toolkit for Speech and Audio Evaluation with Expanded Metrics, Visualization, and LLM Integration.Jiatong Shi, Bo-Hao Su, Shikhar Bharadwaj, Yiwen Zhao, Shih-Heng Wang, Jionghao Hang, Haoran Wang, Wei Wang, Wenhao Feng, Yuxun Tang, Nezih Topaloglu, Siddhant Arora, Jinchuan Tian, William Chen, Hye-jin Shim, Wangyou Zhang, Wen-Chin Huang, Shinji Watanabe
2025ICASSPInvestigating Factors Related to the Naturalness of Synthesized Unison Singing.Kaito Nishizawa, Ryuichi Yamamoto, Wen-Chin Huang, Tomoki Toda
2025InterspeechSHEET: A Multi-purpose Open-source Speech Human Evaluation Estimation Toolkit.Wen-Chin Huang, Erica Cooper, Tomoki Toda
2025InterspeechMitigating Language Mismatch in SSL-Based Speaker Anonymization.Zhe Zhang, Wen-Chin Huang, Xin Wang, Xiaoxiao Miao, Junichi Yamagishi
2024ICASSPElectrolaryngeal Speech Intelligibility Enhancement through Robust Linguistic Encoders.Lester Phillip Violeta, Wen-Chin Huang, Ding Ma, Ryuichi Yamamoto, Kazuhiro Kobayashi, Tomoki Toda
2024InterspeechQuantifying the effect of speech pathology on automatic and human speaker verification.Bence Mark Halpern, Thomas Tienkamp, Wen-Chin Huang, Lester Phillip Violeta, Teja Rebernik, Sebastiaan A. H. J. de Visscher, Max J. H. Witjes, Martijn Wieling, Defne Abur, Tomoki Toda
2023ASRUThe Voicemos Challenge 2023: Zero-Shot Subjective Speech Quality Prediction for Multiple Domains.Erica Cooper, Wen-Chin Huang, Yu Tsao, Hsin-Min Wang, Tomoki Toda, Junichi Yamagishi
2023ASRUImproving Severity Preservation of Healthy-to-Pathological Voice Conversion With Global Style Tokens.Bence Mark Halpern, Wen-Chin Huang, Lester Phillip Violeta, R. J. J. H. van Son, Tomoki Toda
2023ASRUThe Singing Voice Conversion Challenge 2023.Wen-Chin Huang, Lester Phillip Violeta, Songxiang Liu, Jiatong Shi, Tomoki Toda
2023ASRUA Comparative Study of Voice Conversion Models With Large-Scale Speech and Singing Data: The T13 Systems for the Singing Voice Conversion Challenge 2023.Ryuichi Yamamoto, Reo Yoneyama, Lester Phillip Violeta, Wen-Chin Huang, Tomoki Toda
2023ICASSPA Holistic Cascade System, Benchmark, and Human Evaluation Protocol for Expressive Speech-to-Speech Translation.Wen-Chin Huang, Benjamin N. Peloquin, Justine Kao, Changhan Wang, Hongyu Gong, Elizabeth Salesky, Yossi Adi, Ann Lee, Peng-Jen Chen
2023ICASSPIntermediate Fine-Tuning Using Imperfect Synthetic Speech for Improving Electrolaryngeal Speech Recognition.Lester Phillip Violeta, Ding Ma, Wen-Chin Huang, Tomoki Toda
2022ACLSUPERB-SG: Enhanced Speech processing Universal PERformance Benchmark for Semantic and Generative Capabilities.Hsiang-Sheng Tsai, Heng-Jui Chang, Wen-Chin Huang, Zili Huang, Kushal Lakhotia, Shu-Wen Yang, Shuyan Dong, Andy T. Liu, Cheng-I Lai, Jiatong Shi, Xuankai Chang, Phil Hall, Hsuan-Jui Chen, Shang-Wen Li, Shinji Watanabe, Abdelrahman Mohamed, Hung-yi Lee
2022ICASSPGeneralization Ability of MOS Prediction Networks.Erica Cooper, Wen-Chin Huang, Tomoki Toda, Junichi Yamagishi
2022ICASSPLDNet: Unified Listener Dependent Modeling in MOS Prediction for Synthetic Speech.Wen-Chin Huang, Erica Cooper, Junichi Yamagishi, Tomoki Toda
2022ICASSPTowards Identity Preserving Normal to Dysarthric Voice Conversion.Wen-Chin Huang, Bence Mark Halpern, Lester Phillip Violeta, Odette Scharenborg, Tomoki Toda
2022ICASSPS3PRL-VC: Open-Source Voice Conversion Framework with Self-Supervised Speech Representations.Wen-Chin Huang, Shu-Wen Yang, Tomoki Hayashi, Hung-Yi Lee, Shinji Watanabe, Tomoki Toda
2022ICASSPDirect Noisy Speech Modeling for Noisy-To-Noisy Voice Conversion.Chao Xie, Yi-Chiao Wu, Patrick Lumban Tobing, Wen-Chin Huang, Tomoki Toda
2022InterspeechThe VoiceMOS Challenge 2022.Wen-Chin Huang, Erica Cooper, Yu Tsao, Hsin-Min Wang, Tomoki Toda, Junichi Yamagishi
2022InterspeechEnd-to-End Binaural Speech Synthesis.Wen-Chin Huang, Dejan Markovic, Alexander Richard, Israel Dejene Gebru, Anjali Menon
2022InterspeechInvestigating Self-supervised Pretraining Frameworks for Pathological Speech Recognition.Lester Phillip Violeta, Wen-Chin Huang, Tomoki Toda
2021ASRUOn Prosody Modeling for ASR+TTS Based Voice Conversion.Wen-Chin Huang, Tomoki Hayashi, Xinjian Li, Shinji Watanabe, Tomoki Toda
2021ASRUMandarin Electrolaryngeal Speech Voice Conversion with Sequence-to-Sequence Modeling.Ming-Chi Yen, Wen-Chin Huang, Kazuhiro Kobayashi, Yu-Huai Peng, Shu-Wei Tsai, Yu Tsao, Tomoki Toda, Jyh-Shing Roger Jang, Hsin-Min Wang
2021ICASSPNon-Autoregressive Sequence-To-Sequence Voice Conversion.Tomoki Hayashi, Wen-Chin Huang, Kazuhiro Kobayashi, Tomoki Toda
2021ICASSPAny-to-One Sequence-to-Sequence Voice Conversion Using Self-Supervised Discrete Speech Representations.Wen-Chin Huang, Yi-Chiao Wu, Tomoki Hayashi
2021ICASSPSpeech Recognition by Simply Fine-Tuning Bert.Wen-Chin Huang, Chia-Hua Wu, Shang-Bao Luo, Kuan-Yu Chen, Hsin-Min Wang, Tomoki Toda
2021ICASSPCrank: An Open-Source Software for Nonparallel Voice Conversion Based on Vector-Quantized Variational Autoencoder.Kazuhiro Kobayashi, Wen-Chin Huang, Yi-Chiao Wu, Patrick Lumban Tobing, Tomoki Hayashi, Tomoki Toda
2021InterspeechA Preliminary Study of a Two-Stage Paradigm for Preserving Speaker Identity in Dysarthric Voice Conversion.Wen-Chin Huang, Kazuhiro Kobayashi, Yu-Huai Peng, Ching-Feng Liu, Yu Tsao, Hsin-Min Wang, Tomoki Toda
2021InterspeechRelational Data Selection for Data Augmentation of Speaker-Dependent Multi-Band MelGAN Vocoder.Yi-Chiao Wu, Cheng-Hung Hu, Hung-Shin Lee, Yu-Huai Peng, Wen-Chin Huang, Yu Tsao, Hsin-Min Wang, Tomoki Toda
2021ISCASEMA2S: An End-to-End Multimodal Articulatory-to-Speech System.Yu-Wen Chen, Kuo-Hsuan Hung, Shang-Yi Chuang, Jonathan Sherman, Wen-Chin Huang, Xugang Lu, Yu Tsao
2020InterspeechVoice Transformer Network: Sequence-to-Sequence Voice Conversion Using Transformer with Text-to-Speech Pretraining.Wen-Chin Huang, Tomoki Hayashi, Yi-Chiao Wu, Hirokazu Kameoka, Tomoki Toda
2020SEKEAn Empirical Study on Issue Knowledge Transfer from Python to R for Machine Learning Software.Wen-Chin Huang, Zhenlan Ji, Yanhui Li
2019InterspeechInvestigation of F0 Conditioning and Fully Convolutional Networks in Variational Autoencoder Based Voice Conversion.Wen-Chin Huang, Yi-Chiao Wu, Chen-Chou Lo, Patrick Lumban Tobing, Tomoki Hayashi, Kazuhiro Kobayashi, Tomoki Toda, Yu Tsao, Hsin-Min Wang
2019InterspeechMOSNet: Deep Learning-Based Objective Assessment for Voice Conversion.Chen-Chou Lo, Szu-Wei Fu, Wen-Chin Huang, Xin Wang, Junichi Yamagishi, Yu Tsao, Hsin-Min Wang