| 2026 | ACL | Speech-Hands: A Self-Reflection Voice Agentic Approach to Speech Recognition and Audio Reasoning with Omni Perception. | Zhen Wan, Chao-Han Huck Yang, Jinchuan Tian, Hanrong Ye, Ankita Pasad, Szu-Wei Fu, Arushi Goel, Ryo Hachiuma, Shizhe Diao, Kunal Dhawan, Sreyan Ghosh, Yusuke Hirota, Zhehuai Chen, Rafael Valle, Chenhui Chu, Shinji Watanabe, Boris Ginsburg, Yu-Chiang Frank Wang |
| 2025 | ACL | NeKo: Cross-Modality Post-Recognition Error Correction with Tasks-Guided Mixture-of-Experts Language Model. | Yen-Ting Lin, Zhehuai Chen, Piotr Zelasko, Zhen Wan, Xuesong Yang, Zih-Ching Chen, Krishna C. Puvvada, Ke Hu, Szu-Wei Fu, Jun Wei Chiu, Jagadeesh Balam, Boris Ginsburg, Yu-Chiang Frank Wang, Chao-Han Huck Yang |
| 2025 | ASRU | HighRateMOS: Sampling-Rate Aware Modeling for Speech Quality Assessment. | Wenze Ren, Yi-Cheng Lin, Wen-Chin Huang, Ryandhimas E. Zezario, Szu-Wei Fu, Sung-Feng Huang, Erica Cooper, Haibin Wu, Hung-Yu Wei, Hsin-Min Wang, Hung-Yi Lee, Yu Tsao |
| 2025 | ICASSP | Generative Speech Foundation Model Pretraining for High-Quality Speech Extraction and Restoration. | Pin-Jui Ku, Alexander H. Liu, Roman Korostik, Sung-Feng Huang, Szu-Wei Fu, Ante Jukic |
| 2025 | ICASSP | Developing Instruction-Following Speech Language Model Without Speech Instruction-Tuning Data. | Ke-Han Lu, Zhehuai Chen, Szu-Wei Fu, Chao-Han Huck Yang, Jagadeesh Balam, Boris Ginsburg, Yu-Chiang Frank Wang, Hung-Yi Lee |
| 2025 | Interspeech | Universal Speech Enhancement with Regression and Generative Mamba. | Rong Chao, Rauf Nasretdinov, Yu-Chiang Frank Wang, Ante Jukic, Szu-Wei Fu, Yu Tsao |
| 2025 | Interspeech | VoiceNoNG: Robust High-Quality Speech Editing Model without Hallucinations. | Sung-Feng Huang, Heng-Cheng Kuo, Zhehuai Chen, Xuesong Yang, Pin-Jui Ku, Ante Jukic, Huck Yang, Yu Tsao, Yu-Chiang Frank Wang, Hung-yi Lee, Szu-Wei Fu |
| 2024 | ICLR | Self-Supervised Speech Quality Estimation and Enhancement Using Only Clean Speech. | Szu-Wei Fu, Kuo-Hsuan Hung, Yu Tsao, Yu-Chiang Frank Wang |
| 2024 | Interspeech | DeSTA: Enhancing Speech Language Models through Descriptive Speech-Text Alignment. | Ke-Han Lu, Zhehuai Chen, Szu-Wei Fu, He Huang, Boris Ginsburg, Yu-Chiang Frank Wang, Hung-yi Lee |
| 2024 | MMSP | Exploiting Consistency-Preserving Loss and Perceptual Contrast Stretching to Boost SSL-Based Speech Enhancement. | Muhammad Salman Khan, Moreno La Quatra, Kuo-Hsuan Hung, Szu-Wei Fu, Sabato Marco Siniscalchi, Yu Tsao |
| 2023 | ASRU | Study on the Correlation Between Objective Evaluations and Subjective Speech Quality and Intelligibility. | Hsin-Tien Chiang, Kuo-Hsuan Hung, Szu-Wei Fu, Heng-Cheng Kuo, Ming-Hsueh Tsai, Yu Tsao |
| 2023 | ICASSP | Real-Time Speech Interruption Analysis: from Cloud to Client Deployment. | Quchen Fu, Szu-Wei Fu, Yaran Fan, Yu Wu, Zhuo Chen, Jayant Gupchup, Ross Cutler |
| 2022 | ICASSP | MetricGAN-U: Unsupervised Speech Enhancement/ Dereverberation Based Only on Noisy/ Reverberated Speech. | Szu-Wei Fu, Cheng Yu, Kuo-Hsuan Hung, Mirco Ravanelli, Yu Tsao |
| 2022 | Interspeech | Perceptual Contrast Stretching on Target Feature for Speech Enhancement. | Rong Chao, Cheng Yu, Szu-Wei Fu, Xugang Lu, Yu Tsao |
| 2022 | Interspeech | Boosting Self-Supervised Embeddings for Speech Enhancement. | Kuo-Hsuan Hung, Szu-Wei Fu, Huan-Hsin Tseng, Hsin-Tien Chiang, Yu Tsao, Chii-Wann Lin |
| 2022 | Interspeech | OSSEM: one-shot speaker adaptive speech enhancement using meta learning. | Cheng Yu, Szu-Wei Fu, Tsun-An Hsieh, Yu Tsao, Mirco Ravanelli |
| 2022 | Interspeech | MTI-Net: A Multi-Target Speech Intelligibility Prediction Model. | Ryandhimas Edo Zezario, Szu-Wei Fu, Fei Chen, Chiou-Shann Fuh, Hsin-Min Wang, Yu Tsao |
| 2021 | Interspeech | MetricGAN+: An Improved Version of MetricGAN for Speech Enhancement. | Szu-Wei Fu, Cheng Yu, Tsun-An Hsieh, Peter Plantinga, Mirco Ravanelli, Xugang Lu, Yu Tsao |
| 2021 | Interspeech | Improving Perceptual Quality by Phone-Fortified Perceptual Loss Using Wasserstein Distance for Speech Enhancement. | Tsun-An Hsieh, Cheng Yu, Szu-Wei Fu, Xugang Lu, Yu Tsao |
| 2020 | Interspeech | iMetricGAN: Intelligibility Enhancement for Speech-in-Noise Using Generative Adversarial Network-Based Metric Learning. | Haoyu Li, Szu-Wei Fu, Yu Tsao, Junichi Yamagishi |
| 2019 | ICML | MetricGAN: Generative Adversarial Networks based Black-box Metric Scores Optimization for Speech Enhancement. | Szu-Wei Fu, Chien-Feng Liao, Yu Tsao, Shou-De Lin |
| 2019 | Interspeech | IA-NET: Acceleration and Compression of Speech Enhancement Using Integer-Adder Deep Neural Network. | Yu-Chen Lin, Yi-Te Hsu, Szu-Wei Fu, Yu Tsao, Tei-Wei Kuo |
| 2019 | Interspeech | MOSNet: Deep Learning-Based Objective Assessment for Voice Conversion. | Chen-Chou Lo, Szu-Wei Fu, Wen-Chin Huang, Xin Wang, Junichi Yamagishi, Yu Tsao, Hsin-Min Wang |
| 2019 | Interspeech | Specialized Speech Enhancement Model Selection Based on Learned Non-Intrusive Quality Assessment Metric. | Ryandhimas E. Zezario, Szu-Wei Fu, Xugang Lu, Hsin-Min Wang, Yu Tsao |
| 2018 | Interspeech | Quality-Net: An End-to-End Non-intrusive Speech Quality Assessment Model Based on BLSTM. | Szu-Wei Fu, Yu Tsao, Hsin-Te Hwang, Hsin-Min Wang |
| 2016 | Interspeech | SNR-Aware Convolutional Neural Network Modeling for Speech Enhancement. | Szu-Wei Fu, Yu Tsao, Xugang Lu |