Wen-Chin Huang
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
36
Venues
6
Active years
2019–2025
Best venue rank
A*
Where they publish
Papers
36 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ASRU | The AudioMOS Challenge 2025. | Wen-Chin Huang, Hui Wang, Cheng Liu, Yi-Chiao Wu, Andros Tjandra, Wei-Ning Hsu, Erica Cooper, Yong Qin, Tomoki Toda |
| 2025 | ASRU | HighRateMOS: Sampling-Rate Aware Modeling for Speech Quality Assessment. | Wenze Ren, Yi-Cheng Lin, Wen-Chin Huang, Ryandhimas E. Zezario, Szu-Wei Fu, Sung-Feng Huang, Erica Cooper, Haibin Wu, Hung-Yu Wei, Hsin-Min Wang, Hung-Yi Lee, Yu Tsao |
| 2025 | ASRU | VERSA-v2: A Modular and Scalable Toolkit for Speech and Audio Evaluation with Expanded Metrics, Visualization, and LLM Integration. | Jiatong Shi, Bo-Hao Su, Shikhar Bharadwaj, Yiwen Zhao, Shih-Heng Wang, Jionghao Hang, Haoran Wang, Wei Wang, Wenhao Feng, Yuxun Tang, Nezih Topaloglu, Siddhant Arora, Jinchuan Tian, William Chen, Hye-jin Shim, Wangyou Zhang, Wen-Chin Huang, Shinji Watanabe |
| 2025 | ICASSP | Investigating Factors Related to the Naturalness of Synthesized Unison Singing. | Kaito Nishizawa, Ryuichi Yamamoto, Wen-Chin Huang, Tomoki Toda |
| 2025 | Interspeech | SHEET: A Multi-purpose Open-source Speech Human Evaluation Estimation Toolkit. | Wen-Chin Huang, Erica Cooper, Tomoki Toda |
| 2025 | Interspeech | Mitigating Language Mismatch in SSL-Based Speaker Anonymization. | Zhe Zhang, Wen-Chin Huang, Xin Wang, Xiaoxiao Miao, Junichi Yamagishi |
| 2024 | ICASSP | Electrolaryngeal Speech Intelligibility Enhancement through Robust Linguistic Encoders. | Lester Phillip Violeta, Wen-Chin Huang, Ding Ma, Ryuichi Yamamoto, Kazuhiro Kobayashi, Tomoki Toda |
| 2024 | Interspeech | Quantifying the effect of speech pathology on automatic and human speaker verification. | Bence Mark Halpern, Thomas Tienkamp, Wen-Chin Huang, Lester Phillip Violeta, Teja Rebernik, Sebastiaan A. H. J. de Visscher, Max J. H. Witjes, Martijn Wieling, Defne Abur, Tomoki Toda |
| 2023 | ASRU | The Voicemos Challenge 2023: Zero-Shot Subjective Speech Quality Prediction for Multiple Domains. | Erica Cooper, Wen-Chin Huang, Yu Tsao, Hsin-Min Wang, Tomoki Toda, Junichi Yamagishi |
| 2023 | ASRU | Improving Severity Preservation of Healthy-to-Pathological Voice Conversion With Global Style Tokens. | Bence Mark Halpern, Wen-Chin Huang, Lester Phillip Violeta, R. J. J. H. van Son, Tomoki Toda |
| 2023 | ASRU | The Singing Voice Conversion Challenge 2023. | Wen-Chin Huang, Lester Phillip Violeta, Songxiang Liu, Jiatong Shi, Tomoki Toda |
| 2023 | ASRU | A Comparative Study of Voice Conversion Models With Large-Scale Speech and Singing Data: The T13 Systems for the Singing Voice Conversion Challenge 2023. | Ryuichi Yamamoto, Reo Yoneyama, Lester Phillip Violeta, Wen-Chin Huang, Tomoki Toda |
| 2023 | ICASSP | A Holistic Cascade System, Benchmark, and Human Evaluation Protocol for Expressive Speech-to-Speech Translation. | Wen-Chin Huang, Benjamin N. Peloquin, Justine Kao, Changhan Wang, Hongyu Gong, Elizabeth Salesky, Yossi Adi, Ann Lee, Peng-Jen Chen |
| 2023 | ICASSP | Intermediate Fine-Tuning Using Imperfect Synthetic Speech for Improving Electrolaryngeal Speech Recognition. | Lester Phillip Violeta, Ding Ma, Wen-Chin Huang, Tomoki Toda |
| 2022 | ACL | SUPERB-SG: Enhanced Speech processing Universal PERformance Benchmark for Semantic and Generative Capabilities. | Hsiang-Sheng Tsai, Heng-Jui Chang, Wen-Chin Huang, Zili Huang, Kushal Lakhotia, Shu-Wen Yang, Shuyan Dong, Andy T. Liu, Cheng-I Lai, Jiatong Shi, Xuankai Chang, Phil Hall, Hsuan-Jui Chen, Shang-Wen Li, Shinji Watanabe, Abdelrahman Mohamed, Hung-yi Lee |
| 2022 | ICASSP | Generalization Ability of MOS Prediction Networks. | Erica Cooper, Wen-Chin Huang, Tomoki Toda, Junichi Yamagishi |
| 2022 | ICASSP | LDNet: Unified Listener Dependent Modeling in MOS Prediction for Synthetic Speech. | Wen-Chin Huang, Erica Cooper, Junichi Yamagishi, Tomoki Toda |
| 2022 | ICASSP | Towards Identity Preserving Normal to Dysarthric Voice Conversion. | Wen-Chin Huang, Bence Mark Halpern, Lester Phillip Violeta, Odette Scharenborg, Tomoki Toda |
| 2022 | ICASSP | S3PRL-VC: Open-Source Voice Conversion Framework with Self-Supervised Speech Representations. | Wen-Chin Huang, Shu-Wen Yang, Tomoki Hayashi, Hung-Yi Lee, Shinji Watanabe, Tomoki Toda |
| 2022 | ICASSP | Direct Noisy Speech Modeling for Noisy-To-Noisy Voice Conversion. | Chao Xie, Yi-Chiao Wu, Patrick Lumban Tobing, Wen-Chin Huang, Tomoki Toda |
| 2022 | Interspeech | The VoiceMOS Challenge 2022. | Wen-Chin Huang, Erica Cooper, Yu Tsao, Hsin-Min Wang, Tomoki Toda, Junichi Yamagishi |
| 2022 | Interspeech | End-to-End Binaural Speech Synthesis. | Wen-Chin Huang, Dejan Markovic, Alexander Richard, Israel Dejene Gebru, Anjali Menon |
| 2022 | Interspeech | Investigating Self-supervised Pretraining Frameworks for Pathological Speech Recognition. | Lester Phillip Violeta, Wen-Chin Huang, Tomoki Toda |
| 2021 | ASRU | On Prosody Modeling for ASR+TTS Based Voice Conversion. | Wen-Chin Huang, Tomoki Hayashi, Xinjian Li, Shinji Watanabe, Tomoki Toda |
| 2021 | ASRU | Mandarin Electrolaryngeal Speech Voice Conversion with Sequence-to-Sequence Modeling. | Ming-Chi Yen, Wen-Chin Huang, Kazuhiro Kobayashi, Yu-Huai Peng, Shu-Wei Tsai, Yu Tsao, Tomoki Toda, Jyh-Shing Roger Jang, Hsin-Min Wang |
| 2021 | ICASSP | Non-Autoregressive Sequence-To-Sequence Voice Conversion. | Tomoki Hayashi, Wen-Chin Huang, Kazuhiro Kobayashi, Tomoki Toda |
| 2021 | ICASSP | Any-to-One Sequence-to-Sequence Voice Conversion Using Self-Supervised Discrete Speech Representations. | Wen-Chin Huang, Yi-Chiao Wu, Tomoki Hayashi |
| 2021 | ICASSP | Speech Recognition by Simply Fine-Tuning Bert. | Wen-Chin Huang, Chia-Hua Wu, Shang-Bao Luo, Kuan-Yu Chen, Hsin-Min Wang, Tomoki Toda |
| 2021 | ICASSP | Crank: An Open-Source Software for Nonparallel Voice Conversion Based on Vector-Quantized Variational Autoencoder. | Kazuhiro Kobayashi, Wen-Chin Huang, Yi-Chiao Wu, Patrick Lumban Tobing, Tomoki Hayashi, Tomoki Toda |
| 2021 | Interspeech | A Preliminary Study of a Two-Stage Paradigm for Preserving Speaker Identity in Dysarthric Voice Conversion. | Wen-Chin Huang, Kazuhiro Kobayashi, Yu-Huai Peng, Ching-Feng Liu, Yu Tsao, Hsin-Min Wang, Tomoki Toda |
| 2021 | Interspeech | Relational Data Selection for Data Augmentation of Speaker-Dependent Multi-Band MelGAN Vocoder. | Yi-Chiao Wu, Cheng-Hung Hu, Hung-Shin Lee, Yu-Huai Peng, Wen-Chin Huang, Yu Tsao, Hsin-Min Wang, Tomoki Toda |
| 2021 | ISCAS | EMA2S: An End-to-End Multimodal Articulatory-to-Speech System. | Yu-Wen Chen, Kuo-Hsuan Hung, Shang-Yi Chuang, Jonathan Sherman, Wen-Chin Huang, Xugang Lu, Yu Tsao |
| 2020 | Interspeech | Voice Transformer Network: Sequence-to-Sequence Voice Conversion Using Transformer with Text-to-Speech Pretraining. | Wen-Chin Huang, Tomoki Hayashi, Yi-Chiao Wu, Hirokazu Kameoka, Tomoki Toda |
| 2020 | SEKE | An Empirical Study on Issue Knowledge Transfer from Python to R for Machine Learning Software. | Wen-Chin Huang, Zhenlan Ji, Yanhui Li |
| 2019 | Interspeech | Investigation of F0 Conditioning and Fully Convolutional Networks in Variational Autoencoder Based Voice Conversion. | Wen-Chin Huang, Yi-Chiao Wu, Chen-Chou Lo, Patrick Lumban Tobing, Tomoki Hayashi, Kazuhiro Kobayashi, Tomoki Toda, Yu Tsao, Hsin-Min Wang |
| 2019 | Interspeech | MOSNet: Deep Learning-Based Objective Assessment for Voice Conversion. | Chen-Chou Lo, Szu-Wei Fu, Wen-Chin Huang, Xin Wang, Junichi Yamagishi, Yu Tsao, Hsin-Min Wang |