| 2024 | ACL | On the Evaluation of Speech Foundation Models for Spoken Language Understanding. | Siddhant Arora, Ankita Pasad, Chung-Ming Chien, Jionghao Han, Roshan S. Sharma, Jee-weon Jung, Hira Dhamyal, William Chen, Suwon Shon, Hung-yi Lee, Karen Livescu, Shinji Watanabe |
| 2024 | ICASSP | AV2WAV: Diffusion-Based Re-Synthesis from Continuous Self-Supervised Features for Audio-Visual Speech Enhancement. | Ju-Chieh Chou, Chung-Ming Chien, Karen Livescu |
| 2024 | Interspeech | Learning Fine-Grained Controllability on Speech Generation via Efficient Fine-Tuning. | Chung-Ming Chien, Andros Tjandra, Apoorv Vyas, Matt Le, Bowen Shi, Wei-Ning Hsu |
| 2023 | ASRU | Few-Shot Spoken Language Understanding Via Joint Speech-Text Models. | Chung-Ming Chien, Mingjiamei Zhang, Ju-Chieh Chou, Karen Livescu |
| 2023 | EMNLP | Toward Joint Language Modeling for Speech Units and Text. | Ju-Chieh Chou, Chung-Ming Chien, Wei-Ning Hsu, Karen Livescu, Arun Babu, Alexis Conneau, Alexei Baevski, Michael Auli |
| 2022 | ICASSP | Voice Filter: Few-Shot Text-to-Speech Speaker Adaptation Using Voice Conversion as a Post-Processing Module. | Adam Gabrys, Goeric Huybrechts, Manuel Sam Ribeiro, Chung-Ming Chien, Julian Roth, Giulia Comini, Roberto Barra-Chicote, Bartek Perz, Jaime Lorenzo-Trueba |
| 2021 | ICASSP | Investigating on Incorporating Pretrained and Learnable Speaker Representations for Multi-Speaker Multi-Style Text-to-Speech. | Chung-Ming Chien, Jheng-Hao Lin, Chien-yu Huang, Po-Chun Hsu, Hung-yi Lee |
| 2021 | ICASSP | Fragmentvc: Any-To-Any Voice Conversion by End-To-End Extracting and Fusing Fine-Grained Voice Fragments with Attention. | Yist Y. Lin, Chung-Ming Chien, Jheng-Hao Lin, Hung-yi Lee, Lin-Shan Lee |
| 2021 | Interspeech | S2VC: A Framework for Any-to-Any Voice Conversion with Self-Supervised Pretrained Representations. | Jheng-Hao Lin, Yist Y. Lin, Chung-Ming Chien, Hung-yi Lee |