| 2026 | ACL | An Exploration of Mamba for Speech Self-Supervised Models. | Tzu-Quan Lin, Heng-Cheng Kuo, Tzu-Chieh Wei, Hsi-Chun Cheng, Chun Wei Chen, Hsien-Fu Hsiao, Yu Tsao, Hung-yi Lee |
| 2025 | ACL | QualiSpeech: A Speech Quality Assessment Dataset with Natural Language Reasoning and Descriptions. | Siyin Wang, Wenyi Yu, Xianzhao Chen, Xiaohai Tian, Jun Zhang, Lu Lu, Yu Tsao, Junichi Yamagishi, Yuxuan Wang, Chao Zhang |
| 2025 | ASRU | HighRateMOS: Sampling-Rate Aware Modeling for Speech Quality Assessment. | Wenze Ren, Yi-Cheng Lin, Wen-Chin Huang, Ryandhimas E. Zezario, Szu-Wei Fu, Sung-Feng Huang, Erica Cooper, Haibin Wu, Hung-Yu Wei, Hsin-Min Wang, Hung-Yi Lee, Yu Tsao |
| 2025 | ASRU | Improving Perceptual Audio Aesthetic Assessment via Triplet Loss and Self-Supervised Embeddings. | Dyah A. M. G. Wisnu, Ryandhimas E. Zezario, Stefano Rini, Hsin-Min Wang, Yu Tsao |
| 2025 | ICASSP | Speech Enhancement with MAP-based Training for Robust ASR. | You-Jin Li, Rong Chao, Borching Su, Yu Tsao |
| 2025 | ICASSP | MSECG: Incorporating Mamba for Robust and Efficient ECG Super-Resolution. | Jie Lin, I Chiu, Kuan-Chen Wang, Kai-Chun Liu, Hsin-Min Wang, Ping-Cheng Yeh, Yu Tsao |
| 2025 | ICASSP | MSEMG: Surface Electromyography Denoising with a Mamba-based Efficient Network. | Yu-Tung Liu, Kuan-Chen Wang, Rong Chao, Sabato Marco Siniscalchi, Ping-Cheng Yeh, Yu Tsao |
| 2025 | ICASSP | Neural Variational Mode Decomposition and Its Application for ECG Denoising. | De-Yan Lu, Jian-Jiun Ding, Yu Tsao |
| 2025 | ICASSP | Leveraging Joint Spectral and Spatial Learning with MAMBA for Multichannel Speech Enhancement. | Wenze Ren, Haibin Wu, Yi-Cheng Lin, Xuanjun Chen, Rong Chao, Kuo-Hsuan Hung, You-Jin Li, Wen-Yuan Ting, Hsin-Min Wang, Yu Tsao |
| 2025 | ICASSP | A Study on Zero-shot Non-intrusive Speech Assessment using Large Language Models. | Ryandhimas E. Zezario, Sabato Marco Siniscalchi, Hsin-Min Wang, Yu Tsao |
| 2025 | Interspeech | A Study on Speech Assessment with Visual Cues. | Shafique Ahmed, Ryandhimas E. Zezario, Nasir Saleem, Amir Hussain, Hsin-Min Wang, Yu Tsao |
| 2025 | Interspeech | Universal Speech Enhancement with Regression and Generative Mamba. | Rong Chao, Rauf Nasretdinov, Yu-Chiang Frank Wang, Ante Jukic, Szu-Wei Fu, Yu Tsao |
| 2025 | Interspeech | ZSDEVC: Zero-Shot Diffusion-based Emotional Voice Conversion with Disentangled Mechanism. | Hsing-Hang Chou, Yun-Shao Lin, Ching-Chin Sung, Yu Tsao, Chi-Chun Lee |
| 2025 | Interspeech | VoiceNoNG: Robust High-Quality Speech Editing Model without Hallucinations. | Sung-Feng Huang, Heng-Cheng Kuo, Zhehuai Chen, Xuesong Yang, Pin-Jui Ku, Ante Jukic, Huck Yang, Yu Tsao, Yu-Chiang Frank Wang, Hung-yi Lee, Szu-Wei Fu |
| 2025 | Interspeech | Cross-modal Knowledge Transfer Learning as Graph Matching Based on Optimal Transport for ASR. | Xugang Lu, Peng Shen, Yu Tsao, Hisashi Kawai |
| 2025 | Interspeech | A Comparative Study on Proactive and Passive Detection of Deepfake Speech. | Chia-Hua Wu, Wanying Ge, Xin Wang, Junichi Yamagishi, Yu Tsao, Hsin-Min Wang |
| 2025 | Interspeech | Feature Importance across Domains for Improving Non-Intrusive Speech Intelligibility Prediction in Hearing Aids. | Ryandhimas E. Zezario, Sabato Marco Siniscalchi, Fei Chen, Hsin-Min Wang, Yu Tsao |
| 2024 | GLOBECOM | DNN-Based Precoding in RIS-Aided mmWave MIMO Systems With Practical Phase Shift. | Po-Heng Chou, Ching-Wen Chen, Wan-Jen Huang, Walid Saad, Yu Tsao, Ronald Y. Chang |
| 2024 | ICASSP | SDEMG: Score-Based Diffusion Model for Surface Electromyographic Signal Denoising. | Yu-Tung Liu, Kuan-Chen Wang, Kai-Chun Liu, Sheng-Yu Peng, Yu Tsao |
| 2024 | ICASSP | Hierarchical Cross-Modality Knowledge Transfer with Sinkhorn Attention for CTC-Based ASR. | Xugang Lu, Peng Shen, Yu Tsao, Hisashi Kawai |
| 2024 | ICASSP | AV-SUPERB: A Multi-Task Evaluation Benchmark for Audio-Visual Representation Models. | Yuan Tseng, Layne Berry, Yiting Chen, I-Hsiang Chiu, Hsuan-Hao Lin, Max Liu, Puyuan Peng, Yi-Jen Shih, Hung-Yu Wang, Haibin Wu, Poyao Huang, Chun-Mao Lai, Shang-Wen Li, David Harwath, Yu Tsao, Abdelrahman Mohamed, Chi-Luen Feng, Hung-Yi Lee |
| 2024 | ICASSP | Scalable Ensemble-Based Detection Method Against Adversarial Attacks For Speaker Verification. | Haibin Wu, Heng-Cheng Kuo, Yu Tsao, Hung-Yi Lee |
| 2024 | ICASSP | Multi-Task Pseudo-Label Learning for Non-Intrusive Speech Quality Assessment Model. | Ryandhimas E. Zezario, Bo-Ren Brian Bai, Chiou-Shann Fuh, Hsin-Min Wang, Yu Tsao |
| 2024 | ICLR | Self-Supervised Speech Quality Estimation and Enhancement Using Only Clean Speech. | Szu-Wei Fu, Kuo-Hsuan Hung, Yu Tsao, Yu-Chiang Frank Wang |
| 2024 | Interspeech | Learnable Layer Selection and Model Fusion for Speech Self-Supervised Learning Models. | Sheng-Chieh Chiu, Chia-Hua Wu, Jih-Kang Hsieh, Yu Tsao, Hsin-Min Wang |
| 2024 | Interspeech | SVSNet+: Enhancing Speaker Voice Similarity Assessment Models with Representations from Speech Foundation Models. | Chun Yin, Tai-Shih Chi, Yu Tsao, Hsin-Min Wang |
| 2024 | Interspeech | Non-Intrusive Speech Intelligibility Prediction for Hearing Aids using Whisper and Metadata. | Ryandhimas E. Zezario, Fei Chen, Chiou-Shann Fuh, Hsin-Min Wang, Yu Tsao |
| 2024 | MMSP | Exploiting Consistency-Preserving Loss and Perceptual Contrast Stretching to Boost SSL-Based Speech Enhancement. | Muhammad Salman Khan, Moreno La Quatra, Kuo-Hsuan Hung, Szu-Wei Fu, Sabato Marco Siniscalchi, Yu Tsao |
| 2024 | PIMRC | Capacity-Net-Based RIS Precoding Design Without Channel Estimation for mmWave MIMO System. | Chun-Yuan Huang, Po-Heng Chou, Wan-Jen Huang, Ying-Ren Chien, Yu Tsao |
| 2023 | ASRU | Study on the Correlation Between Objective Evaluations and Subjective Speech Quality and Intelligibility. | Hsin-Tien Chiang, Kuo-Hsuan Hung, Szu-Wei Fu, Heng-Cheng Kuo, Ming-Hsueh Tsai, Yu Tsao |
| 2023 | ASRU | The Voicemos Challenge 2023: Zero-Shot Subjective Speech Quality Prediction for Multiple Domains. | Erica Cooper, Wen-Chin Huang, Yu Tsao, Hsin-Min Wang, Tomoki Toda, Junichi Yamagishi |
| 2023 | ASRU | LC4SV: A Denoising Framework Learning to Compensate for Unseen Speaker Verification Models. | Chi-Chang Lee, Hong-Wei Chen, Chu-Song Chen, Hsin-Min Wang, Tsung-Te Liu, Yu Tsao |
| 2023 | ASRU | Cross-Modal Alignment With Optimal Transport For CTC-Based ASR. | Xugang Lu, Peng Shen, Yu Tsao, Hisashi Kawai |
| 2023 | ICASSP | Audio-Visual Speech Enhancement and Separation by Utilizing Multi-Modal Self-Supervised Embeddings. | I-Chun Chern, Kuo-Hsuan Hung, Yi-Ting Chen, Tassadaq Hussain, Mandar Gogate, Amir Hussain, Yu Tsao, Jen-Cheng Hou |
| 2023 | ICASSP | Prefallkd: Pre-Impact Fall Detection Via CNN-ViT Knowledge Distillation. | Tin-Han Chi, Kai-Chun Liu, Chia-Yeh Hsieh, Yu Tsao, Chia-Tai Chan |
| 2023 | ICASSP | T5lephone: Bridging Speech and Text Self-Supervised Models for Spoken Language Understanding Via Phoneme Level T5. | Chan-Jan Hsu, Ho-Lam Chung, Hung-Yi Lee, Yu Tsao |
| 2023 | ICASSP | Towards Individualised Speech Enhancement: An SNR Preference Learning System for Multi-Modal Hearing Aids. | Jasper Kirton-Wingate, Shafique Ahmed, Mandar Gogate, Yu Tsao, Amir Hussain |
| 2023 | ICASSP | On the Robustness of Non-Intrusive Speech Quality Model by Adversarial Examples. | Hsin-Yi Lin, Huan-Hsin Tseng, Yu Tsao |
| 2023 | ICASSP | ECG Artifact Removal from Single-Channel Surface EMG Using Fully Convolutional Networks. | Kuan-Chen Wang, Kai-Chun Liu, Sheng-Yu Peng, Yu Tsao |
| 2023 | ICLR | D4AM: A General Denoising Framework for Downstream Acoustic Models. | Chi-Chang Lee, Yu Tsao, Hsin-Min Wang, Chu-Song Chen |
| 2023 | ICLR | Interpretations of Domain Adaptations via Layer Variational Analysis. | Huan-Hsin Tseng, Hsin-Yi Lin, Kuo-Hsuan Hung, Yu Tsao |
| 2023 | Interspeech | Mandarin Electrolaryngeal Speech Voice Conversion using Cross-domain Features. | Hsin-Hao Chen, Yung-Lun Chien, Ming-Chi Yen, Shu-Wei Tsai, Tai-Shih Chi, Hsin-Min Wang, Yu Tsao |
| 2023 | Interspeech | A Training and Inference Strategy Using Noisy and Enhanced Speech as Target for Speech Enhancement without Clean Speech. | Li-Wei Chen, Yao-Fei Cheng, Hung-Shin Lee, Yu Tsao, Hsin-Min Wang |
| 2023 | Interspeech | Audio-Visual Mandarin Electrolaryngeal Speech Voice Conversion. | Yung-Lun Chien, Hsin-Hao Chen, Ming-Chi Yen, Shu-Wei Tsai, Hsin-Min Wang, Yu Tsao, Tai-Shih Chi |
| 2023 | Interspeech | Neural Model Reprogramming with Similarity Based Mapping for Low-Resource Spoken Command Recognition. | Hao Yen, Pin-Jui Ku, Chao-Han Huck Yang, Hu Hu, Sabato Marco Siniscalchi, Pin-Yu Chen, Yu Tsao |
| 2022 | ACL | XDBERT: Distilling Visual Information to BERT from Cross-Modal Systems to Improve Language Understanding. | Chan-Jan Hsu, Hung-yi Lee, Yu Tsao |
| 2022 | GLOBECOM | Key Generation with Ambient Audio. | Bo-Rong Chen, Hsin-Tien Chiang, Heng-Cheng Kuo, Yu Tsao, Yih-Chun Hu |
| 2022 | ICASSP | MetricGAN-U: Unsupervised Speech Enhancement/ Dereverberation Based Only on Noisy/ Reverberated Speech. | Szu-Wei Fu, Cheng Yu, Kuo-Hsuan Hung, Mirco Ravanelli, Yu Tsao |
| 2022 | ICASSP | Speech Recovery For Real-World Self-Powered Intermittent Devices. | Yu-Chen Lin, Tsun-An Hsieh, Kuo-Hsuan Hung, Cheng Yu, Harinath Garudadri, Yu Tsao, Tei-Wei Kuo |
| 2022 | ICASSP | Analyzing The Robustness of Unsupervised Speech Recognition. | Guan-Ting Lin, Chan-Jan Hsu, Da-Rong Liu, Hung-Yi Lee, Yu Tsao |
| 2022 | ICASSP | Conditional Diffusion Probabilistic Model for Speech Enhancement. | Yen-Ju Lu, Zhong-Qiu Wang, Shinji Watanabe, Alexander Richard, Cheng Yu, Yu Tsao |
| 2022 | ICASSP | EMGSE: Acoustic/EMG Fusion for Multimodal Speech Enhancement. | Kuan-Chen Wang, Kai-Chun Liu, Hsin-Min Wang, Yu Tsao |
| 2022 | ICASSP | Partially Fake Audio Detection by Self-Attention-Based Fake Span Discovery. | Haibin Wu, Heng-Cheng Kuo, Naijun Zheng, Kuo-Hsuan Hung, Hung-Yi Lee, Yu Tsao, Hsin-Min Wang, Helen Meng |
| 2022 | ICASSP | When BERT Meets Quantum Temporal Convolution Learning for Text Classification in Heterogeneous Computing. | Chao-Han Huck Yang, Jun Qi, Samuel Yen-Chi Chen, Yu Tsao, Pin-Yu Chen |
| 2022 | Interspeech | Perceptual Contrast Stretching on Target Feature for Speech Enhancement. | Rong Chao, Cheng Yu, Szu-Wei Fu, Xugang Lu, Yu Tsao |
| 2022 | Interspeech | InQSS: a speech intelligibility and quality assessment model using a multi-task learning network. | Yu-Wen Chen, Yu Tsao |
| 2022 | Interspeech | The VoiceMOS Challenge 2022. | Wen-Chin Huang, Erica Cooper, Yu Tsao, Hsin-Min Wang, Tomoki Toda, Junichi Yamagishi |
| 2022 | Interspeech | Boosting Self-Supervised Embeddings for Speech Enhancement. | Kuo-Hsuan Hung, Szu-Wei Fu, Huan-Hsin Tseng, Hsin-Tien Chiang, Yu Tsao, Chii-Wann Lin |
| 2022 | Interspeech | NASTAR: Noise Adaptive Speech Enhancement with Target-Conditional Resampling. | Chi-Chang Lee, Cheng-Hung Hu, Yu-Chen Lin, Chu-Song Chen, Hsin-Min Wang, Yu Tsao |
| 2022 | Interspeech | ESPnet-SE++: Speech Enhancement for Robust Speech Recognition, Translation, and Understanding. | Yen-Ju Lu, Xuankai Chang, Chenda Li, Wangyou Zhang, Samuele Cornell, Zhaoheng Ni, Yoshiki Masuyama, Brian Yan, Robin Scheibler, Zhong-Qiu Wang, Yu Tsao, Yanmin Qian, Shinji Watanabe |
| 2022 | Interspeech | Perceptual Characteristics Based Multi-objective Model for Speech Enhancement. | Chiang-Jen Peng, Yun-Ju Chan, Yih-Liang Shen, Cheng Yu, Yu Tsao, Tai-Shih Chi |
| 2022 | Interspeech | Disentangling the Impacts of Language and Channel Variability on Speech Separation Networks. | Fan-Lin Wang, Hung-Shin Lee, Yu Tsao, Hsin-Min Wang |
| 2022 | Interspeech | OSSEM: one-shot speaker adaptive speech enhancement using meta learning. | Cheng Yu, Szu-Wei Fu, Tsun-An Hsieh, Yu Tsao, Mirco Ravanelli |
| 2022 | Interspeech | MBI-Net: A Non-Intrusive Multi-Branched Speech Intelligibility Prediction Model for Hearing Aids. | Ryandhimas Edo Zezario, Fei Chen, Chiou-Shann Fuh, Hsin-Min Wang, Yu Tsao |
| 2022 | Interspeech | MTI-Net: A Multi-Target Speech Intelligibility Prediction Model. | Ryandhimas Edo Zezario, Szu-Wei Fu, Fei Chen, Chiou-Shann Fuh, Hsin-Min Wang, Yu Tsao |
| 2021 | ASRU | An Exploration of Self-Supervised Pretrained Representations for End-to-End Speech Recognition. | Xuankai Chang, Takashi Maekaku, Pengcheng Guo, Jing Shi, Yen-Ju Lu, Aswin Shanmugam Subramanian, Tianzi Wang, Shu-Wen Yang, Yu Tsao, Hung-yi Lee, Shinji Watanabe |
| 2021 | ASRU | HASA-Net: A Non-Intrusive Hearing-Aid Speech Assessment Network. | Hsin-Tien Chiang, Yi-Chiao Wu, Cheng Yu, Tomoki Toda, Hsin-Min Wang, Yih-Chun Hu, Yu Tsao |
| 2021 | ASRU | Mandarin Electrolaryngeal Speech Voice Conversion with Sequence-to-Sequence Modeling. | Ming-Chi Yen, Wen-Chin Huang, Kazuhiro Kobayashi, Yu-Huai Peng, Shu-Wei Tsai, Yu Tsao, Tomoki Toda, Jyh-Shing Roger Jang, Hsin-Min Wang |
| 2021 | ICASSP | Unsupervised Neural Adaptation Model Based on Optimal Transport for Spoken Language Identification. | Xugang Lu, Peng Shen, Yu Tsao, Hisashi Kawai |
| 2021 | ICASSP | One Shot Learning for Speech Separation. | Yuan-Kuei Wu, Kuan-Po Huang, Yu Tsao, Hung-yi Lee |
| 2021 | Interspeech | MetricGAN+: An Improved Version of MetricGAN for Speech Enhancement. | Szu-Wei Fu, Cheng Yu, Tsun-An Hsieh, Peter Plantinga, Mirco Ravanelli, Xugang Lu, Yu Tsao |
| 2021 | Interspeech | Improving Perceptual Quality by Phone-Fortified Perceptual Loss Using Wasserstein Distance for Speech Enhancement. | Tsun-An Hsieh, Cheng Yu, Szu-Wei Fu, Xugang Lu, Yu Tsao |
| 2021 | Interspeech | A Preliminary Study of a Two-Stage Paradigm for Preserving Speaker Identity in Dysarthric Voice Conversion. | Wen-Chin Huang, Kazuhiro Kobayashi, Yu-Huai Peng, Ching-Feng Liu, Yu Tsao, Hsin-Min Wang, Tomoki Toda |
| 2021 | Interspeech | QISTA-Net-Audio: Audio Super-Resolution via Non-Convex ℓ_q-Norm Minimization. | Gang-Xuan Lin, Shih-Wei Hu, Yen-Ju Lu, Yu Tsao, Chun-Shien Lu |
| 2021 | Interspeech | Relational Data Selection for Data Augmentation of Speaker-Dependent Multi-Band MelGAN Vocoder. | Yi-Chiao Wu, Cheng-Hung Hu, Hung-Shin Lee, Yu-Huai Peng, Wen-Chin Huang, Yu Tsao, Hsin-Min Wang, Tomoki Toda |
| 2021 | ISCAS | EMA2S: An End-to-End Multimodal Articulatory-to-Speech System. | Yu-Wen Chen, Kuo-Hsuan Hung, Shang-Yi Chuang, Jonathan Sherman, Wen-Chin Huang, Xugang Lu, Yu Tsao |
| 2021 | ISCAS | Attention-Based Multi-Task Learning for Speech-Enhancement and Speaker-Identification in Multi-Speaker Dialogue Scenario. | Chiang-Jen Peng, Yun-Ju Chan, Cheng Yu, Syu-Siang Wang, Yu Tsao, Tai-Shih Chi |
| 2020 | GLOBECOM | Cross-Technology Interference Mitigation Using Fully Convolutional Denoising Autoencoders. | Chi-Lun Lin, Kate Ching-Ju Lin, Chi-Cheng Lee, Yu Tsao |
| 2020 | ICASSP | Self-Supervised Denoising Autoencoder with Linear Regression Decoder for Speech Enhancement. | Ryandhimas E. Zezario, Tassadaq Hussain, Xugang Lu, Hsin-Min Wang, Yu Tsao |
| 2020 | ICIP | Space-Time Guided Association Learning For Unsupervised Person Re-Identification. | Chih-Wei Wu, Chih-Ting Liu, Wei-Chih Tu, Yu Tsao, Yu-Chiang Frank Wang, Shao-Yi Chien |
| 2020 | Interspeech | Enhancing Intelligibility of Dysarthric Speech Using Gated Convolutional-Based Voice Conversion System. | Chen-Yu Chen, Wei-Zhong Zheng, Syu-Siang Wang, Yu Tsao, Pei-Chun Li, Ying-Hui Lai |
| 2020 | Interspeech | Lite Audio-Visual Speech Enhancement. | Shang-Yi Chuang, Yu Tsao, Chen-Chou Lo, Hsin-Min Wang |
| 2020 | Interspeech | SERIL: Noise Adaptive Speech Enhancement Using Regularization-Based Incremental Learning. | Chi-Chang Lee, Yu-Chen Lin, Hsuan-Tien Lin, Hsin-Min Wang, Yu Tsao |
| 2020 | Interspeech | iMetricGAN: Intelligibility Enhancement for Speech-in-Noise Using Generative Adversarial Network-Based Metric Learning. | Haoyu Li, Szu-Wei Fu, Yu Tsao, Junichi Yamagishi |
| 2020 | Interspeech | Incorporating Broad Phonetic Information for Speech Enhancement. | Yen-Ju Lu, Chien-Feng Liao, Xugang Lu, Jeih-weih Hung, Yu Tsao |
| 2019 | ICASSP | Reinforcement Learning Based Speech Enhancement for Robust Speech Recognition. | Yih-Liang Shen, Chao-Yuan Huang, Syu-Siang Wang, Yu Tsao, Hsin-Min Wang, Tai-Shih Chi |
| 2019 | ICML | MetricGAN: Generative Adversarial Networks based Black-box Metric Scores Optimization for Speech Enhancement. | Szu-Wei Fu, Chien-Feng Liao, Yu Tsao, Shou-De Lin |
| 2019 | Interspeech | Generative Adversarial Networks for Unpaired Voice Transformation on Impaired Speech. | Li-Wei Chen, Hung-yi Lee, Yu Tsao |
| 2019 | Interspeech | Speaker-Aware Deep Denoising Autoencoder with Embedded Speaker Identity for Speech Enhancement. | Fu-Kai Chuang, Syu-Siang Wang, Jeih-weih Hung, Yu Tsao, Shih-Hau Fang |
| 2019 | Interspeech | Exploring the Encoder Layers of Discriminative Autoencoders for LVCSR. | Pin-Tuan Huang, Hung-Shin Lee, Syu-Siang Wang, Kuan-Yu Chen, Yu Tsao, Hsin-Min Wang |
| 2019 | Interspeech | Investigation of F0 Conditioning and Fully Convolutional Networks in Variational Autoencoder Based Voice Conversion. | Wen-Chin Huang, Yi-Chiao Wu, Chen-Chou Lo, Patrick Lumban Tobing, Tomoki Hayashi, Kazuhiro Kobayashi, Tomoki Toda, Yu Tsao, Hsin-Min Wang |
| 2019 | Interspeech | Incorporating Symbolic Sequential Modeling for Speech Enhancement. | Chien-Feng Liao, Yu Tsao, Xugang Lu, Hisashi Kawai |
| 2019 | Interspeech | Noise Adaptive Speech Enhancement Using Domain Adversarial Training. | Chien-Feng Liao, Yu Tsao, Hung-yi Lee, Hsin-Min Wang |
| 2019 | Interspeech | IA-NET: Acceleration and Compression of Speech Enhancement Using Integer-Adder Deep Neural Network. | Yu-Chen Lin, Yi-Te Hsu, Szu-Wei Fu, Yu Tsao, Tei-Wei Kuo |
| 2019 | Interspeech | MOSNet: Deep Learning-Based Objective Assessment for Voice Conversion. | Chen-Chou Lo, Szu-Wei Fu, Wen-Chin Huang, Xin Wang, Junichi Yamagishi, Yu Tsao, Hsin-Min Wang |
| 2019 | Interspeech | Class-Wise Centroid Distance Metric Learning for Acoustic Event Detection. | Xugang Lu, Peng Shen, Sheng Li, Yu Tsao, Hisashi Kawai |
| 2019 | Interspeech | Specialized Speech Enhancement Model Selection Based on Learned Non-Intrusive Quality Assessment Metric. | Ryandhimas E. Zezario, Szu-Wei Fu, Xugang Lu, Hsin-Min Wang, Yu Tsao |
| 2018 | ICASSP | Speech Dereverberation Based on Integrated Deep and Ensemble Learning Algorithm. | Wei-Jen Lee, Syu-Siang Wang, Fei Chen, Xugang Lu, Shao-Yi Chien, Yu Tsao |
| 2018 | ICASSP | Enhancement and Analysis of Conversational Speech: JSALT 2017. | Neville Ryant, Elika Bergelson, Kenneth Church, Alejandrina Cristi, Jun Du, Sriram Ganapathy, Sanjeev Khudanpur, Diana Kowalski, Mahesh Krishnamoorthy, Rajat Kulshreshta, Mark Y. Liberman, Yu-Ding Lu, Matthew Maciejewski, Florian Metze, Jn Profant, Lei Sun, Yu Tsao, Zhou Yu |
| 2018 | ICASSP | A Novel LSTM-Based Speech Preprocessor for Speaker Diarization in Realistic Mismatch Conditions. | Lei Sun, Jun Du, Tian Gao, Yu-Ding Lu, Yu Tsao, Chin-Hui Lee, Neville Ryant |
| 2018 | Interspeech | Quality-Net: An End-to-End Non-intrusive Speech Quality Assessment Model Based on BLSTM. | Szu-Wei Fu, Yu Tsao, Hsin-Te Hwang, Hsin-Min Wang |
| 2018 | Interspeech | Temporal Attentive Pooling for Acoustic Event Detection. | Xugang Lu, Peng Shen, Sheng Li, Yu Tsao, Hisashi Kawai |
| 2018 | Interspeech | Exemplar-Based Spectral Detail Compensation for Voice Conversion. | Yu-Huai Peng, Hsin-Te Hwang, Yi-Chiao Wu, Yu Tsao, Hsin-Min Wang |
| 2017 | ACSSC | Acoustic echo cancellation using deep cerebellar model articulation controller. | Shih-Wei Lan, Yu Tsao, Junghsi Lee |
| 2017 | CVPR | Track-Clustering Error Evaluation for Track-Based Multi-camera Tracking System Employing Human Re-identification. | Chih-Wei Wu, Meng-Ting Zhong, Yu Tsao, Shao-Wen Yang, Yen-Kuang Chen, Shao-Yi Chien |
| 2017 | ICASSP | Discriminative autoencoders for speaker verification. | Hung-Shin Lee, Yu-Ding Lu, Chin-Cheng Hsu, Yu Tsao, Hsin-Min Wang, Shyh-Kang Jeng |
| 2017 | ICASSP | A locally linear embbeding based postfiltering approach for speech enhancement. | Yi-Chiao Wu, Hsin-Te Hwang, Syu-Siang Wang, Chin-Cheng Hsu, Ying-Hui Lai, Yu Tsao, Hsin-Min Wang |
| 2017 | Interspeech | Voice Conversion from Unaligned Corpora Using Variational Autoencoding Wasserstein Generative Adversarial Networks. | Chin-Cheng Hsu, Hsin-Te Hwang, Yi-Chiao Wu, Yu Tsao, Hsin-Min Wang |
| 2017 | Interspeech | Wavelet Speech Enhancement Based on Robust Principal Component Analysis. | Chia-Lung Wu, Hsiang-Ping Hsu, Syu-Siang Wang, Jeih-Weih Hung, Ying-Hui Lai, Hsin-Min Wang, Yu Tsao |
| 2017 | Interspeech | A Post-Filtering Approach Based on Locally Linear Embedding Difference Compensation for Speech Enhancement. | Yi-Chiao Wu, Hsin-Te Hwang, Syu-Siang Wang, Chin-Cheng Hsu, Yu Tsao, Hsin-Min Wang |
| 2017 | Interspeech | Discriminative Autoencoders for Acoustic Modeling. | Ming-Han Yang, Hung-Shin Lee, Yu-Ding Lu, Kuan-Yu Chen, Yu Tsao, Berlin Chen, Hsin-Min Wang |
| 2017 | ISCAS | Object-based on-line video summarization for internet of video things. | Shih-Ting Lin, Yuan-Hsin Liao, Yu Tsao, Shao-Yi Chien |
| 2016 | ICASSP | Nonnegative matrix factorization-based frequency lowering technology for Mandarin-speaking hearing aid users. | Yen-Teh Liu, Yu Tsao, Ronald Y. Chang |
| 2016 | Interspeech | SNR-Aware Convolutional Neural Network Modeling for Speech Enhancement. | Szu-Wei Fu, Yu Tsao, Xugang Lu |
| 2016 | Interspeech | Minimization of Regression and Ranking Losses with Shallow Neural Networks on Automatic Sincerity Evaluation. | Hung-Shin Lee, Yu Tsao, Chi-Chun Lee, Hsin-Min Wang, Wei-Cheng Lin, Wei-Chen Chen, Shan-Wen Hsiao, Shyh-Kang Jeng |
| 2016 | Interspeech | Pair-Wise Distance Metric Learning of Neural Network Model for Spoken Language Identification. | Xugang Lu, Peng Shen, Yu Tsao, Hisashi Kawai |
| 2016 | Interspeech | Locally Linear Embedding for Exemplar-Based Spectral Conversion. | Yi-Chiao Wu, Hsin-Te Hwang, Chin-Cheng Hsu, Yu Tsao, Hsin-Min Wang |
| 2016 | MMM | Image Retrieval Using Color-Aware Tag on Progressive Image Search and Recommendation System. | Shih-Yu Ku, Kai-Hsiang Chen, Jen-Wei Huang, Yu Tsao |
| 2015 | ICASSP | Multimodal arousal rating using unsupervised fusion technique. | Wei-Chen Chen, Po-Tsun Lai, Yu Tsao, Chi-Chun Lee |
| 2015 | ICASSP | A discriminative post-filter for speech enhancement in hearing aids. | Ying-Hui Lai, Syu-Siang Wang, Pei-Chun Li, Yu Tsao |
| 2015 | Interspeech | Speech recognition with temporal neural networks. | Payton Lin, Dau-Cheng Lyu, Yun-Fan Chang, Yu Tsao |
| 2015 | Interspeech | Sparse representation with temporal max-smoothing for acoustic event detection. | Xugang Lu, Peng Shen, Yu Tsao, Chiori Hori, Hisashi Kawai |
| 2014 | ICASSP | Speech enhancement using segmental nonnegative matrix factorization. | Hao-Teng Fan, Jeih-weih Hung, Xugang Lu, Syu-Siang Wang, Yu Tsao |
| 2014 | ICASSP | Sparse representation based on a bag of spectral exemplars for acoustic event detection. | Xugang Lu, Yu Tsao, Shigeki Matsuda, Chiori Hori |
| 2014 | ICDM | A Transfer Probabilistic Collective Factorization Model to Handle Sparse Data in Collaborative Filtering. | How Jing, An-Chun Liang, Shou-De Lin, Yu Tsao |
| 2014 | Interspeech | Ensemble of machine learning algorithms for cognitive and physical speaker load detection. | How Jing, Ting-Yao Hu, Hung-Shin Lee, Wei-Chen Chen, Chi-Chun Lee, Yu Tsao, Hsin-Min Wang |
| 2014 | Interspeech | An adaptive envelope compression strategy for speech processing in cochlear implants. | Ying-Hui Lai, Fei Chen, Yu Tsao |
| 2014 | Interspeech | Clustering-based i-vector formulation for speaker recognition. | Hung-Shin Lee, Yu Tsao, Hsin-Min Wang, Shyh-Kang Jeng |
| 2014 | Interspeech | Automatic speech recognition with primarily temporal envelope information. | Payton Lin, Fei Chen, Syu-Siang Wang, Ying-Hui Lai, Yu Tsao |
| 2014 | Interspeech | Ensemble modeling of denoising autoencoder for speech spectrum restoration. | Xugang Lu, Yu Tsao, Shigeki Matsuda, Chiori Hori |
| 2013 | ICASSP | Speech enhancement using generalized maximum a posteriori spectral amplitude estimator. | Yu-Cheng Su, Yu Tsao, Jung-En Wu, Fu-Rong Jean |
| 2013 | ICASSP | Filtering on the temporal probability sequence in histogram equalization for robust speech recognition. | Syu-Siang Wang, Yu Tsao, Jeih-Weih Hung |
| 2013 | IJCNLP | Semantic Nave Bayes Classifier for Document Classification. | How Jing, Yu Tsao, Kuan-Yu Chen, Hsin-Min Wang |
| 2013 | IJCNN | Sparse maximum entropy deep belief nets. | How Jing, Yu Tsao |
| 2013 | Interspeech | Alleviating the over-smoothing problem in GMM-based voice conversion with discriminative training. | Hsin-Te Hwang, Yu Tsao, Hsin-Min Wang, Yih-Ru Wang, Sin-Horng Chen |
| 2013 | Interspeech | Ensemble of machine learning and acoustic segment model techniques for speech emotion and autism spectrum disorders recognition. | Hung-yi Lee, Ting-Yao Hu, How Jing, Yun-Fan Chang, Yu Tsao, Yu-Cheng Kao, Tsang-Long Pao |
| 2013 | Interspeech | An investigation of spectral restoration algorithms for deep neural networks based noise robust speech recognition. | Bo Li, Yu Tsao, Khe Chai Sim |
| 2013 | Interspeech | Speech enhancement based on deep denoising autoencoder. | Xugang Lu, Yu Tsao, Shigeki Matsuda, Chiori Hori |
| 2013 | Interspeech | Recurrent neural network based language model personalization by social network crowdsourcing. | Tsung-Hsien Wen, Aaron Heidel, Hung-yi Lee, Yu Tsao, Lin-Shan Lee |
| 2012 | ICASSP | A linear projection approach to environment modeling for robust speech recognition. | Yu Tsao, Chien-Lin Huang, Shigeki Matsuda, Chiori Hori, Hideki Kashioka |
| 2012 | Interspeech | Discriminative Fuzzy Clustering Maximum a Posterior Linear Regression for Speaker Adaptation. | Ting-Yao Hu, Yu Tsao, Lin-Shan Lee |
| 2012 | Interspeech | A Study of Mutual Information for GMM-Based Spectral Conversion. | Hsin-Te Hwang, Yu Tsao, Hsin-Min Wang, Yih-Ru Wang, Sin-Horng Chen |
| 2011 | ICASSP | Increasing discriminative capability on MAP-based mapping function estimation for acoustic model adaptation. | Yu Tsao, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura |
| 2011 | ICASSP | A sampling-based environment population projection approach for rapid acoustic model adaptation. | Yu Tsao, Shigeki Matsuda, Shinsuke Sakai, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura |
| 2011 | Interspeech | Incorporating Regional Information to Enhance MAP-Based Stochastic Feature Compensation for Robust Speech Recognition. | Yu Tsao, Paul R. Dixon, Chiori Hori, Hisashi Kawai |
| 2010 | ICASSP | An acoustic segment model approach to incorporating temporal information into speaker modeling for text-independent speaker recognition. | Yu Tsao, Hanwu Sun, Haizhou Li, Chin-Hui Lee |
| 2010 | Interspeech | Shrinkage model adaptation in automatic speech recognition. | Jinyu Li, Yu Tsao, Chin-Hui Lee |
| 2010 | Interspeech | A particle filter feature compensation approach to robust speech recognition. | Aleem Mushtaq, Yu Tsao, Chin-Hui Lee |
| 2009 | ASRU | MAP estimation of online mapping parameters in ensemble speaker and speaking environment modeling. | Yu Tsao, Shigeki Matsuda, Satoshi Nakamura, Chin-Hui Lee |
| 2009 | ICASSP | Ensemble speaker and speaking environment modeling approach with advanced online estimation process. | Yu Tsao, Jinyu Li, Chin-Hui Lee |
| 2009 | Interspeech | A study on soft margin estimation of linear regression parameters for speaker adaptation. | Shigeki Matsuda, Yu Tsao, Jinyu Li, Satoshi Nakamura, Chin-Hui Lee |
| 2008 | ICASSP | A programmable analog radial-basis-function based classifier. | Sheng-Yu Peng, Yu Tsao, Paul E. Hasler, David V. Anderson |
| 2008 | Interspeech | Improving the ensemble speaker and speaking environment modeling approach by enhancing the precision of the online estimation process. | Yu Tsao, Chin-Hui Lee |
| 2007 | ASRU | Two extensions to ensemble speaker and speaking environment modeling for robust automatic speech recognition. | Yu Tsao, Chin-Hui Lee |
| 2007 | Interspeech | Detection-based ASR in the automatic speech attribute transcription project. | Ilana Bromberg, Qian Qian, Jun Hou, Jinyu Li, Chengyuan Ma, Brett Matthews, Antonio Moreno-Daniel, Jeremy Morris, Sabato Marco Siniscalchi, Yu Tsao, Yu Wang |
| 2007 | Interspeech | An ensemble modeling approach to joint characterization of speaker and speaking environments. | Yu Tsao, Chin-Hui Lee |
| 2006 | Interspeech | A study on detection based automatic speech recognition. | Chengyuan Ma, Yu Tsao, Chin-Hui Lee |
| 2006 | Interspeech | A vector space approach to environment modeling for robust speech recognition. | Yu Tsao, Chin-Hui Lee |
| 2005 | ICASSP | A Study on Knowledge Source Integration for Candidate Rescoring in Automatic Speech Recognition. | Jinyu Li, Yu Tsao, Chin-Hui Lee |
| 2005 | Interspeech | A study on separation between acoustic models and its applications. | Yu Tsao, Jinyu Li, Chin-Hui Lee |
| 2001 | Interspeech | Segmental eigenvoice for rapid speaker adaptation. | Yu Tsao, Shang-Ming Lee, Fu-Chiang Chou, Lin-Shan Lee |