Skip to content

Yu Tsao

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

161

Venues

17

Active years

2001–2026

Best venue rank

A*

Where they publish

Papers

161 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLAn Exploration of Mamba for Speech Self-Supervised Models.Tzu-Quan Lin, Heng-Cheng Kuo, Tzu-Chieh Wei, Hsi-Chun Cheng, Chun Wei Chen, Hsien-Fu Hsiao, Yu Tsao, Hung-yi Lee
2025ACLQualiSpeech: A Speech Quality Assessment Dataset with Natural Language Reasoning and Descriptions.Siyin Wang, Wenyi Yu, Xianzhao Chen, Xiaohai Tian, Jun Zhang, Lu Lu, Yu Tsao, Junichi Yamagishi, Yuxuan Wang, Chao Zhang
2025ASRUHighRateMOS: Sampling-Rate Aware Modeling for Speech Quality Assessment.Wenze Ren, Yi-Cheng Lin, Wen-Chin Huang, Ryandhimas E. Zezario, Szu-Wei Fu, Sung-Feng Huang, Erica Cooper, Haibin Wu, Hung-Yu Wei, Hsin-Min Wang, Hung-Yi Lee, Yu Tsao
2025ASRUImproving Perceptual Audio Aesthetic Assessment via Triplet Loss and Self-Supervised Embeddings.Dyah A. M. G. Wisnu, Ryandhimas E. Zezario, Stefano Rini, Hsin-Min Wang, Yu Tsao
2025ICASSPSpeech Enhancement with MAP-based Training for Robust ASR.You-Jin Li, Rong Chao, Borching Su, Yu Tsao
2025ICASSPMSECG: Incorporating Mamba for Robust and Efficient ECG Super-Resolution.Jie Lin, I Chiu, Kuan-Chen Wang, Kai-Chun Liu, Hsin-Min Wang, Ping-Cheng Yeh, Yu Tsao
2025ICASSPMSEMG: Surface Electromyography Denoising with a Mamba-based Efficient Network.Yu-Tung Liu, Kuan-Chen Wang, Rong Chao, Sabato Marco Siniscalchi, Ping-Cheng Yeh, Yu Tsao
2025ICASSPNeural Variational Mode Decomposition and Its Application for ECG Denoising.De-Yan Lu, Jian-Jiun Ding, Yu Tsao
2025ICASSPLeveraging Joint Spectral and Spatial Learning with MAMBA for Multichannel Speech Enhancement.Wenze Ren, Haibin Wu, Yi-Cheng Lin, Xuanjun Chen, Rong Chao, Kuo-Hsuan Hung, You-Jin Li, Wen-Yuan Ting, Hsin-Min Wang, Yu Tsao
2025ICASSPA Study on Zero-shot Non-intrusive Speech Assessment using Large Language Models.Ryandhimas E. Zezario, Sabato Marco Siniscalchi, Hsin-Min Wang, Yu Tsao
2025InterspeechA Study on Speech Assessment with Visual Cues.Shafique Ahmed, Ryandhimas E. Zezario, Nasir Saleem, Amir Hussain, Hsin-Min Wang, Yu Tsao
2025InterspeechUniversal Speech Enhancement with Regression and Generative Mamba.Rong Chao, Rauf Nasretdinov, Yu-Chiang Frank Wang, Ante Jukic, Szu-Wei Fu, Yu Tsao
2025InterspeechZSDEVC: Zero-Shot Diffusion-based Emotional Voice Conversion with Disentangled Mechanism.Hsing-Hang Chou, Yun-Shao Lin, Ching-Chin Sung, Yu Tsao, Chi-Chun Lee
2025InterspeechVoiceNoNG: Robust High-Quality Speech Editing Model without Hallucinations.Sung-Feng Huang, Heng-Cheng Kuo, Zhehuai Chen, Xuesong Yang, Pin-Jui Ku, Ante Jukic, Huck Yang, Yu Tsao, Yu-Chiang Frank Wang, Hung-yi Lee, Szu-Wei Fu
2025InterspeechCross-modal Knowledge Transfer Learning as Graph Matching Based on Optimal Transport for ASR.Xugang Lu, Peng Shen, Yu Tsao, Hisashi Kawai
2025InterspeechA Comparative Study on Proactive and Passive Detection of Deepfake Speech.Chia-Hua Wu, Wanying Ge, Xin Wang, Junichi Yamagishi, Yu Tsao, Hsin-Min Wang
2025InterspeechFeature Importance across Domains for Improving Non-Intrusive Speech Intelligibility Prediction in Hearing Aids.Ryandhimas E. Zezario, Sabato Marco Siniscalchi, Fei Chen, Hsin-Min Wang, Yu Tsao
2024GLOBECOMDNN-Based Precoding in RIS-Aided mmWave MIMO Systems With Practical Phase Shift.Po-Heng Chou, Ching-Wen Chen, Wan-Jen Huang, Walid Saad, Yu Tsao, Ronald Y. Chang
2024ICASSPSDEMG: Score-Based Diffusion Model for Surface Electromyographic Signal Denoising.Yu-Tung Liu, Kuan-Chen Wang, Kai-Chun Liu, Sheng-Yu Peng, Yu Tsao
2024ICASSPHierarchical Cross-Modality Knowledge Transfer with Sinkhorn Attention for CTC-Based ASR.Xugang Lu, Peng Shen, Yu Tsao, Hisashi Kawai
2024ICASSPAV-SUPERB: A Multi-Task Evaluation Benchmark for Audio-Visual Representation Models.Yuan Tseng, Layne Berry, Yiting Chen, I-Hsiang Chiu, Hsuan-Hao Lin, Max Liu, Puyuan Peng, Yi-Jen Shih, Hung-Yu Wang, Haibin Wu, Poyao Huang, Chun-Mao Lai, Shang-Wen Li, David Harwath, Yu Tsao, Abdelrahman Mohamed, Chi-Luen Feng, Hung-Yi Lee
2024ICASSPScalable Ensemble-Based Detection Method Against Adversarial Attacks For Speaker Verification.Haibin Wu, Heng-Cheng Kuo, Yu Tsao, Hung-Yi Lee
2024ICASSPMulti-Task Pseudo-Label Learning for Non-Intrusive Speech Quality Assessment Model.Ryandhimas E. Zezario, Bo-Ren Brian Bai, Chiou-Shann Fuh, Hsin-Min Wang, Yu Tsao
2024ICLRSelf-Supervised Speech Quality Estimation and Enhancement Using Only Clean Speech.Szu-Wei Fu, Kuo-Hsuan Hung, Yu Tsao, Yu-Chiang Frank Wang
2024InterspeechLearnable Layer Selection and Model Fusion for Speech Self-Supervised Learning Models.Sheng-Chieh Chiu, Chia-Hua Wu, Jih-Kang Hsieh, Yu Tsao, Hsin-Min Wang
2024InterspeechSVSNet+: Enhancing Speaker Voice Similarity Assessment Models with Representations from Speech Foundation Models.Chun Yin, Tai-Shih Chi, Yu Tsao, Hsin-Min Wang
2024InterspeechNon-Intrusive Speech Intelligibility Prediction for Hearing Aids using Whisper and Metadata.Ryandhimas E. Zezario, Fei Chen, Chiou-Shann Fuh, Hsin-Min Wang, Yu Tsao
2024MMSPExploiting Consistency-Preserving Loss and Perceptual Contrast Stretching to Boost SSL-Based Speech Enhancement.Muhammad Salman Khan, Moreno La Quatra, Kuo-Hsuan Hung, Szu-Wei Fu, Sabato Marco Siniscalchi, Yu Tsao
2024PIMRCCapacity-Net-Based RIS Precoding Design Without Channel Estimation for mmWave MIMO System.Chun-Yuan Huang, Po-Heng Chou, Wan-Jen Huang, Ying-Ren Chien, Yu Tsao
2023ASRUStudy on the Correlation Between Objective Evaluations and Subjective Speech Quality and Intelligibility.Hsin-Tien Chiang, Kuo-Hsuan Hung, Szu-Wei Fu, Heng-Cheng Kuo, Ming-Hsueh Tsai, Yu Tsao
2023ASRUThe Voicemos Challenge 2023: Zero-Shot Subjective Speech Quality Prediction for Multiple Domains.Erica Cooper, Wen-Chin Huang, Yu Tsao, Hsin-Min Wang, Tomoki Toda, Junichi Yamagishi
2023ASRULC4SV: A Denoising Framework Learning to Compensate for Unseen Speaker Verification Models.Chi-Chang Lee, Hong-Wei Chen, Chu-Song Chen, Hsin-Min Wang, Tsung-Te Liu, Yu Tsao
2023ASRUCross-Modal Alignment With Optimal Transport For CTC-Based ASR.Xugang Lu, Peng Shen, Yu Tsao, Hisashi Kawai
2023ICASSPAudio-Visual Speech Enhancement and Separation by Utilizing Multi-Modal Self-Supervised Embeddings.I-Chun Chern, Kuo-Hsuan Hung, Yi-Ting Chen, Tassadaq Hussain, Mandar Gogate, Amir Hussain, Yu Tsao, Jen-Cheng Hou
2023ICASSPPrefallkd: Pre-Impact Fall Detection Via CNN-ViT Knowledge Distillation.Tin-Han Chi, Kai-Chun Liu, Chia-Yeh Hsieh, Yu Tsao, Chia-Tai Chan
2023ICASSPT5lephone: Bridging Speech and Text Self-Supervised Models for Spoken Language Understanding Via Phoneme Level T5.Chan-Jan Hsu, Ho-Lam Chung, Hung-Yi Lee, Yu Tsao
2023ICASSPTowards Individualised Speech Enhancement: An SNR Preference Learning System for Multi-Modal Hearing Aids.Jasper Kirton-Wingate, Shafique Ahmed, Mandar Gogate, Yu Tsao, Amir Hussain
2023ICASSPOn the Robustness of Non-Intrusive Speech Quality Model by Adversarial Examples.Hsin-Yi Lin, Huan-Hsin Tseng, Yu Tsao
2023ICASSPECG Artifact Removal from Single-Channel Surface EMG Using Fully Convolutional Networks.Kuan-Chen Wang, Kai-Chun Liu, Sheng-Yu Peng, Yu Tsao
2023ICLRD4AM: A General Denoising Framework for Downstream Acoustic Models.Chi-Chang Lee, Yu Tsao, Hsin-Min Wang, Chu-Song Chen
2023ICLRInterpretations of Domain Adaptations via Layer Variational Analysis.Huan-Hsin Tseng, Hsin-Yi Lin, Kuo-Hsuan Hung, Yu Tsao
2023InterspeechMandarin Electrolaryngeal Speech Voice Conversion using Cross-domain Features.Hsin-Hao Chen, Yung-Lun Chien, Ming-Chi Yen, Shu-Wei Tsai, Tai-Shih Chi, Hsin-Min Wang, Yu Tsao
2023InterspeechA Training and Inference Strategy Using Noisy and Enhanced Speech as Target for Speech Enhancement without Clean Speech.Li-Wei Chen, Yao-Fei Cheng, Hung-Shin Lee, Yu Tsao, Hsin-Min Wang
2023InterspeechAudio-Visual Mandarin Electrolaryngeal Speech Voice Conversion.Yung-Lun Chien, Hsin-Hao Chen, Ming-Chi Yen, Shu-Wei Tsai, Hsin-Min Wang, Yu Tsao, Tai-Shih Chi
2023InterspeechNeural Model Reprogramming with Similarity Based Mapping for Low-Resource Spoken Command Recognition.Hao Yen, Pin-Jui Ku, Chao-Han Huck Yang, Hu Hu, Sabato Marco Siniscalchi, Pin-Yu Chen, Yu Tsao
2022ACLXDBERT: Distilling Visual Information to BERT from Cross-Modal Systems to Improve Language Understanding.Chan-Jan Hsu, Hung-yi Lee, Yu Tsao
2022GLOBECOMKey Generation with Ambient Audio.Bo-Rong Chen, Hsin-Tien Chiang, Heng-Cheng Kuo, Yu Tsao, Yih-Chun Hu
2022ICASSPMetricGAN-U: Unsupervised Speech Enhancement/ Dereverberation Based Only on Noisy/ Reverberated Speech.Szu-Wei Fu, Cheng Yu, Kuo-Hsuan Hung, Mirco Ravanelli, Yu Tsao
2022ICASSPSpeech Recovery For Real-World Self-Powered Intermittent Devices.Yu-Chen Lin, Tsun-An Hsieh, Kuo-Hsuan Hung, Cheng Yu, Harinath Garudadri, Yu Tsao, Tei-Wei Kuo
2022ICASSPAnalyzing The Robustness of Unsupervised Speech Recognition.Guan-Ting Lin, Chan-Jan Hsu, Da-Rong Liu, Hung-Yi Lee, Yu Tsao
2022ICASSPConditional Diffusion Probabilistic Model for Speech Enhancement.Yen-Ju Lu, Zhong-Qiu Wang, Shinji Watanabe, Alexander Richard, Cheng Yu, Yu Tsao
2022ICASSPEMGSE: Acoustic/EMG Fusion for Multimodal Speech Enhancement.Kuan-Chen Wang, Kai-Chun Liu, Hsin-Min Wang, Yu Tsao
2022ICASSPPartially Fake Audio Detection by Self-Attention-Based Fake Span Discovery.Haibin Wu, Heng-Cheng Kuo, Naijun Zheng, Kuo-Hsuan Hung, Hung-Yi Lee, Yu Tsao, Hsin-Min Wang, Helen Meng
2022ICASSPWhen BERT Meets Quantum Temporal Convolution Learning for Text Classification in Heterogeneous Computing.Chao-Han Huck Yang, Jun Qi, Samuel Yen-Chi Chen, Yu Tsao, Pin-Yu Chen
2022InterspeechPerceptual Contrast Stretching on Target Feature for Speech Enhancement.Rong Chao, Cheng Yu, Szu-Wei Fu, Xugang Lu, Yu Tsao
2022InterspeechInQSS: a speech intelligibility and quality assessment model using a multi-task learning network.Yu-Wen Chen, Yu Tsao
2022InterspeechThe VoiceMOS Challenge 2022.Wen-Chin Huang, Erica Cooper, Yu Tsao, Hsin-Min Wang, Tomoki Toda, Junichi Yamagishi
2022InterspeechBoosting Self-Supervised Embeddings for Speech Enhancement.Kuo-Hsuan Hung, Szu-Wei Fu, Huan-Hsin Tseng, Hsin-Tien Chiang, Yu Tsao, Chii-Wann Lin
2022InterspeechNASTAR: Noise Adaptive Speech Enhancement with Target-Conditional Resampling.Chi-Chang Lee, Cheng-Hung Hu, Yu-Chen Lin, Chu-Song Chen, Hsin-Min Wang, Yu Tsao
2022InterspeechESPnet-SE++: Speech Enhancement for Robust Speech Recognition, Translation, and Understanding.Yen-Ju Lu, Xuankai Chang, Chenda Li, Wangyou Zhang, Samuele Cornell, Zhaoheng Ni, Yoshiki Masuyama, Brian Yan, Robin Scheibler, Zhong-Qiu Wang, Yu Tsao, Yanmin Qian, Shinji Watanabe
2022InterspeechPerceptual Characteristics Based Multi-objective Model for Speech Enhancement.Chiang-Jen Peng, Yun-Ju Chan, Yih-Liang Shen, Cheng Yu, Yu Tsao, Tai-Shih Chi
2022InterspeechDisentangling the Impacts of Language and Channel Variability on Speech Separation Networks.Fan-Lin Wang, Hung-Shin Lee, Yu Tsao, Hsin-Min Wang
2022InterspeechOSSEM: one-shot speaker adaptive speech enhancement using meta learning.Cheng Yu, Szu-Wei Fu, Tsun-An Hsieh, Yu Tsao, Mirco Ravanelli
2022InterspeechMBI-Net: A Non-Intrusive Multi-Branched Speech Intelligibility Prediction Model for Hearing Aids.Ryandhimas Edo Zezario, Fei Chen, Chiou-Shann Fuh, Hsin-Min Wang, Yu Tsao
2022InterspeechMTI-Net: A Multi-Target Speech Intelligibility Prediction Model.Ryandhimas Edo Zezario, Szu-Wei Fu, Fei Chen, Chiou-Shann Fuh, Hsin-Min Wang, Yu Tsao
2021ASRUAn Exploration of Self-Supervised Pretrained Representations for End-to-End Speech Recognition.Xuankai Chang, Takashi Maekaku, Pengcheng Guo, Jing Shi, Yen-Ju Lu, Aswin Shanmugam Subramanian, Tianzi Wang, Shu-Wen Yang, Yu Tsao, Hung-yi Lee, Shinji Watanabe
2021ASRUHASA-Net: A Non-Intrusive Hearing-Aid Speech Assessment Network.Hsin-Tien Chiang, Yi-Chiao Wu, Cheng Yu, Tomoki Toda, Hsin-Min Wang, Yih-Chun Hu, Yu Tsao
2021ASRUMandarin Electrolaryngeal Speech Voice Conversion with Sequence-to-Sequence Modeling.Ming-Chi Yen, Wen-Chin Huang, Kazuhiro Kobayashi, Yu-Huai Peng, Shu-Wei Tsai, Yu Tsao, Tomoki Toda, Jyh-Shing Roger Jang, Hsin-Min Wang
2021ICASSPUnsupervised Neural Adaptation Model Based on Optimal Transport for Spoken Language Identification.Xugang Lu, Peng Shen, Yu Tsao, Hisashi Kawai
2021ICASSPOne Shot Learning for Speech Separation.Yuan-Kuei Wu, Kuan-Po Huang, Yu Tsao, Hung-yi Lee
2021InterspeechMetricGAN+: An Improved Version of MetricGAN for Speech Enhancement.Szu-Wei Fu, Cheng Yu, Tsun-An Hsieh, Peter Plantinga, Mirco Ravanelli, Xugang Lu, Yu Tsao
2021InterspeechImproving Perceptual Quality by Phone-Fortified Perceptual Loss Using Wasserstein Distance for Speech Enhancement.Tsun-An Hsieh, Cheng Yu, Szu-Wei Fu, Xugang Lu, Yu Tsao
2021InterspeechA Preliminary Study of a Two-Stage Paradigm for Preserving Speaker Identity in Dysarthric Voice Conversion.Wen-Chin Huang, Kazuhiro Kobayashi, Yu-Huai Peng, Ching-Feng Liu, Yu Tsao, Hsin-Min Wang, Tomoki Toda
2021InterspeechQISTA-Net-Audio: Audio Super-Resolution via Non-Convex ℓ_q-Norm Minimization.Gang-Xuan Lin, Shih-Wei Hu, Yen-Ju Lu, Yu Tsao, Chun-Shien Lu
2021InterspeechRelational Data Selection for Data Augmentation of Speaker-Dependent Multi-Band MelGAN Vocoder.Yi-Chiao Wu, Cheng-Hung Hu, Hung-Shin Lee, Yu-Huai Peng, Wen-Chin Huang, Yu Tsao, Hsin-Min Wang, Tomoki Toda
2021ISCASEMA2S: An End-to-End Multimodal Articulatory-to-Speech System.Yu-Wen Chen, Kuo-Hsuan Hung, Shang-Yi Chuang, Jonathan Sherman, Wen-Chin Huang, Xugang Lu, Yu Tsao
2021ISCASAttention-Based Multi-Task Learning for Speech-Enhancement and Speaker-Identification in Multi-Speaker Dialogue Scenario.Chiang-Jen Peng, Yun-Ju Chan, Cheng Yu, Syu-Siang Wang, Yu Tsao, Tai-Shih Chi
2020GLOBECOMCross-Technology Interference Mitigation Using Fully Convolutional Denoising Autoencoders.Chi-Lun Lin, Kate Ching-Ju Lin, Chi-Cheng Lee, Yu Tsao
2020ICASSPSelf-Supervised Denoising Autoencoder with Linear Regression Decoder for Speech Enhancement.Ryandhimas E. Zezario, Tassadaq Hussain, Xugang Lu, Hsin-Min Wang, Yu Tsao
2020ICIPSpace-Time Guided Association Learning For Unsupervised Person Re-Identification.Chih-Wei Wu, Chih-Ting Liu, Wei-Chih Tu, Yu Tsao, Yu-Chiang Frank Wang, Shao-Yi Chien
2020InterspeechEnhancing Intelligibility of Dysarthric Speech Using Gated Convolutional-Based Voice Conversion System.Chen-Yu Chen, Wei-Zhong Zheng, Syu-Siang Wang, Yu Tsao, Pei-Chun Li, Ying-Hui Lai
2020InterspeechLite Audio-Visual Speech Enhancement.Shang-Yi Chuang, Yu Tsao, Chen-Chou Lo, Hsin-Min Wang
2020InterspeechSERIL: Noise Adaptive Speech Enhancement Using Regularization-Based Incremental Learning.Chi-Chang Lee, Yu-Chen Lin, Hsuan-Tien Lin, Hsin-Min Wang, Yu Tsao
2020InterspeechiMetricGAN: Intelligibility Enhancement for Speech-in-Noise Using Generative Adversarial Network-Based Metric Learning.Haoyu Li, Szu-Wei Fu, Yu Tsao, Junichi Yamagishi
2020InterspeechIncorporating Broad Phonetic Information for Speech Enhancement.Yen-Ju Lu, Chien-Feng Liao, Xugang Lu, Jeih-weih Hung, Yu Tsao
2019ICASSPReinforcement Learning Based Speech Enhancement for Robust Speech Recognition.Yih-Liang Shen, Chao-Yuan Huang, Syu-Siang Wang, Yu Tsao, Hsin-Min Wang, Tai-Shih Chi
2019ICMLMetricGAN: Generative Adversarial Networks based Black-box Metric Scores Optimization for Speech Enhancement.Szu-Wei Fu, Chien-Feng Liao, Yu Tsao, Shou-De Lin
2019InterspeechGenerative Adversarial Networks for Unpaired Voice Transformation on Impaired Speech.Li-Wei Chen, Hung-yi Lee, Yu Tsao
2019InterspeechSpeaker-Aware Deep Denoising Autoencoder with Embedded Speaker Identity for Speech Enhancement.Fu-Kai Chuang, Syu-Siang Wang, Jeih-weih Hung, Yu Tsao, Shih-Hau Fang
2019InterspeechExploring the Encoder Layers of Discriminative Autoencoders for LVCSR.Pin-Tuan Huang, Hung-Shin Lee, Syu-Siang Wang, Kuan-Yu Chen, Yu Tsao, Hsin-Min Wang
2019InterspeechInvestigation of F0 Conditioning and Fully Convolutional Networks in Variational Autoencoder Based Voice Conversion.Wen-Chin Huang, Yi-Chiao Wu, Chen-Chou Lo, Patrick Lumban Tobing, Tomoki Hayashi, Kazuhiro Kobayashi, Tomoki Toda, Yu Tsao, Hsin-Min Wang
2019InterspeechIncorporating Symbolic Sequential Modeling for Speech Enhancement.Chien-Feng Liao, Yu Tsao, Xugang Lu, Hisashi Kawai
2019InterspeechNoise Adaptive Speech Enhancement Using Domain Adversarial Training.Chien-Feng Liao, Yu Tsao, Hung-yi Lee, Hsin-Min Wang
2019InterspeechIA-NET: Acceleration and Compression of Speech Enhancement Using Integer-Adder Deep Neural Network.Yu-Chen Lin, Yi-Te Hsu, Szu-Wei Fu, Yu Tsao, Tei-Wei Kuo
2019InterspeechMOSNet: Deep Learning-Based Objective Assessment for Voice Conversion.Chen-Chou Lo, Szu-Wei Fu, Wen-Chin Huang, Xin Wang, Junichi Yamagishi, Yu Tsao, Hsin-Min Wang
2019InterspeechClass-Wise Centroid Distance Metric Learning for Acoustic Event Detection.Xugang Lu, Peng Shen, Sheng Li, Yu Tsao, Hisashi Kawai
2019InterspeechSpecialized Speech Enhancement Model Selection Based on Learned Non-Intrusive Quality Assessment Metric.Ryandhimas E. Zezario, Szu-Wei Fu, Xugang Lu, Hsin-Min Wang, Yu Tsao
2018ICASSPSpeech Dereverberation Based on Integrated Deep and Ensemble Learning Algorithm.Wei-Jen Lee, Syu-Siang Wang, Fei Chen, Xugang Lu, Shao-Yi Chien, Yu Tsao
2018ICASSPEnhancement and Analysis of Conversational Speech: JSALT 2017.Neville Ryant, Elika Bergelson, Kenneth Church, Alejandrina Cristi, Jun Du, Sriram Ganapathy, Sanjeev Khudanpur, Diana Kowalski, Mahesh Krishnamoorthy, Rajat Kulshreshta, Mark Y. Liberman, Yu-Ding Lu, Matthew Maciejewski, Florian Metze, Jn Profant, Lei Sun, Yu Tsao, Zhou Yu
2018ICASSPA Novel LSTM-Based Speech Preprocessor for Speaker Diarization in Realistic Mismatch Conditions.Lei Sun, Jun Du, Tian Gao, Yu-Ding Lu, Yu Tsao, Chin-Hui Lee, Neville Ryant
2018InterspeechQuality-Net: An End-to-End Non-intrusive Speech Quality Assessment Model Based on BLSTM.Szu-Wei Fu, Yu Tsao, Hsin-Te Hwang, Hsin-Min Wang
2018InterspeechTemporal Attentive Pooling for Acoustic Event Detection.Xugang Lu, Peng Shen, Sheng Li, Yu Tsao, Hisashi Kawai
2018InterspeechExemplar-Based Spectral Detail Compensation for Voice Conversion.Yu-Huai Peng, Hsin-Te Hwang, Yi-Chiao Wu, Yu Tsao, Hsin-Min Wang
2017ACSSCAcoustic echo cancellation using deep cerebellar model articulation controller.Shih-Wei Lan, Yu Tsao, Junghsi Lee
2017CVPRTrack-Clustering Error Evaluation for Track-Based Multi-camera Tracking System Employing Human Re-identification.Chih-Wei Wu, Meng-Ting Zhong, Yu Tsao, Shao-Wen Yang, Yen-Kuang Chen, Shao-Yi Chien
2017ICASSPDiscriminative autoencoders for speaker verification.Hung-Shin Lee, Yu-Ding Lu, Chin-Cheng Hsu, Yu Tsao, Hsin-Min Wang, Shyh-Kang Jeng
2017ICASSPA locally linear embbeding based postfiltering approach for speech enhancement.Yi-Chiao Wu, Hsin-Te Hwang, Syu-Siang Wang, Chin-Cheng Hsu, Ying-Hui Lai, Yu Tsao, Hsin-Min Wang
2017InterspeechVoice Conversion from Unaligned Corpora Using Variational Autoencoding Wasserstein Generative Adversarial Networks.Chin-Cheng Hsu, Hsin-Te Hwang, Yi-Chiao Wu, Yu Tsao, Hsin-Min Wang
2017InterspeechWavelet Speech Enhancement Based on Robust Principal Component Analysis.Chia-Lung Wu, Hsiang-Ping Hsu, Syu-Siang Wang, Jeih-Weih Hung, Ying-Hui Lai, Hsin-Min Wang, Yu Tsao
2017InterspeechA Post-Filtering Approach Based on Locally Linear Embedding Difference Compensation for Speech Enhancement.Yi-Chiao Wu, Hsin-Te Hwang, Syu-Siang Wang, Chin-Cheng Hsu, Yu Tsao, Hsin-Min Wang
2017InterspeechDiscriminative Autoencoders for Acoustic Modeling.Ming-Han Yang, Hung-Shin Lee, Yu-Ding Lu, Kuan-Yu Chen, Yu Tsao, Berlin Chen, Hsin-Min Wang
2017ISCASObject-based on-line video summarization for internet of video things.Shih-Ting Lin, Yuan-Hsin Liao, Yu Tsao, Shao-Yi Chien
2016ICASSPNonnegative matrix factorization-based frequency lowering technology for Mandarin-speaking hearing aid users.Yen-Teh Liu, Yu Tsao, Ronald Y. Chang
2016InterspeechSNR-Aware Convolutional Neural Network Modeling for Speech Enhancement.Szu-Wei Fu, Yu Tsao, Xugang Lu
2016InterspeechMinimization of Regression and Ranking Losses with Shallow Neural Networks on Automatic Sincerity Evaluation.Hung-Shin Lee, Yu Tsao, Chi-Chun Lee, Hsin-Min Wang, Wei-Cheng Lin, Wei-Chen Chen, Shan-Wen Hsiao, Shyh-Kang Jeng
2016InterspeechPair-Wise Distance Metric Learning of Neural Network Model for Spoken Language Identification.Xugang Lu, Peng Shen, Yu Tsao, Hisashi Kawai
2016InterspeechLocally Linear Embedding for Exemplar-Based Spectral Conversion.Yi-Chiao Wu, Hsin-Te Hwang, Chin-Cheng Hsu, Yu Tsao, Hsin-Min Wang
2016MMMImage Retrieval Using Color-Aware Tag on Progressive Image Search and Recommendation System.Shih-Yu Ku, Kai-Hsiang Chen, Jen-Wei Huang, Yu Tsao
2015ICASSPMultimodal arousal rating using unsupervised fusion technique.Wei-Chen Chen, Po-Tsun Lai, Yu Tsao, Chi-Chun Lee
2015ICASSPA discriminative post-filter for speech enhancement in hearing aids.Ying-Hui Lai, Syu-Siang Wang, Pei-Chun Li, Yu Tsao
2015InterspeechSpeech recognition with temporal neural networks.Payton Lin, Dau-Cheng Lyu, Yun-Fan Chang, Yu Tsao
2015InterspeechSparse representation with temporal max-smoothing for acoustic event detection.Xugang Lu, Peng Shen, Yu Tsao, Chiori Hori, Hisashi Kawai
2014ICASSPSpeech enhancement using segmental nonnegative matrix factorization.Hao-Teng Fan, Jeih-weih Hung, Xugang Lu, Syu-Siang Wang, Yu Tsao
2014ICASSPSparse representation based on a bag of spectral exemplars for acoustic event detection.Xugang Lu, Yu Tsao, Shigeki Matsuda, Chiori Hori
2014ICDMA Transfer Probabilistic Collective Factorization Model to Handle Sparse Data in Collaborative Filtering.How Jing, An-Chun Liang, Shou-De Lin, Yu Tsao
2014InterspeechEnsemble of machine learning algorithms for cognitive and physical speaker load detection.How Jing, Ting-Yao Hu, Hung-Shin Lee, Wei-Chen Chen, Chi-Chun Lee, Yu Tsao, Hsin-Min Wang
2014InterspeechAn adaptive envelope compression strategy for speech processing in cochlear implants.Ying-Hui Lai, Fei Chen, Yu Tsao
2014InterspeechClustering-based i-vector formulation for speaker recognition.Hung-Shin Lee, Yu Tsao, Hsin-Min Wang, Shyh-Kang Jeng
2014InterspeechAutomatic speech recognition with primarily temporal envelope information.Payton Lin, Fei Chen, Syu-Siang Wang, Ying-Hui Lai, Yu Tsao
2014InterspeechEnsemble modeling of denoising autoencoder for speech spectrum restoration.Xugang Lu, Yu Tsao, Shigeki Matsuda, Chiori Hori
2013ICASSPSpeech enhancement using generalized maximum a posteriori spectral amplitude estimator.Yu-Cheng Su, Yu Tsao, Jung-En Wu, Fu-Rong Jean
2013ICASSPFiltering on the temporal probability sequence in histogram equalization for robust speech recognition.Syu-Siang Wang, Yu Tsao, Jeih-Weih Hung
2013IJCNLPSemantic Nave Bayes Classifier for Document Classification.How Jing, Yu Tsao, Kuan-Yu Chen, Hsin-Min Wang
2013IJCNNSparse maximum entropy deep belief nets.How Jing, Yu Tsao
2013InterspeechAlleviating the over-smoothing problem in GMM-based voice conversion with discriminative training.Hsin-Te Hwang, Yu Tsao, Hsin-Min Wang, Yih-Ru Wang, Sin-Horng Chen
2013InterspeechEnsemble of machine learning and acoustic segment model techniques for speech emotion and autism spectrum disorders recognition.Hung-yi Lee, Ting-Yao Hu, How Jing, Yun-Fan Chang, Yu Tsao, Yu-Cheng Kao, Tsang-Long Pao
2013InterspeechAn investigation of spectral restoration algorithms for deep neural networks based noise robust speech recognition.Bo Li, Yu Tsao, Khe Chai Sim
2013InterspeechSpeech enhancement based on deep denoising autoencoder.Xugang Lu, Yu Tsao, Shigeki Matsuda, Chiori Hori
2013InterspeechRecurrent neural network based language model personalization by social network crowdsourcing.Tsung-Hsien Wen, Aaron Heidel, Hung-yi Lee, Yu Tsao, Lin-Shan Lee
2012ICASSPA linear projection approach to environment modeling for robust speech recognition.Yu Tsao, Chien-Lin Huang, Shigeki Matsuda, Chiori Hori, Hideki Kashioka
2012InterspeechDiscriminative Fuzzy Clustering Maximum a Posterior Linear Regression for Speaker Adaptation.Ting-Yao Hu, Yu Tsao, Lin-Shan Lee
2012InterspeechA Study of Mutual Information for GMM-Based Spectral Conversion.Hsin-Te Hwang, Yu Tsao, Hsin-Min Wang, Yih-Ru Wang, Sin-Horng Chen
2011ICASSPIncreasing discriminative capability on MAP-based mapping function estimation for acoustic model adaptation.Yu Tsao, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura
2011ICASSPA sampling-based environment population projection approach for rapid acoustic model adaptation.Yu Tsao, Shigeki Matsuda, Shinsuke Sakai, Ryosuke Isotani, Hisashi Kawai, Satoshi Nakamura
2011InterspeechIncorporating Regional Information to Enhance MAP-Based Stochastic Feature Compensation for Robust Speech Recognition.Yu Tsao, Paul R. Dixon, Chiori Hori, Hisashi Kawai
2010ICASSPAn acoustic segment model approach to incorporating temporal information into speaker modeling for text-independent speaker recognition.Yu Tsao, Hanwu Sun, Haizhou Li, Chin-Hui Lee
2010InterspeechShrinkage model adaptation in automatic speech recognition.Jinyu Li, Yu Tsao, Chin-Hui Lee
2010InterspeechA particle filter feature compensation approach to robust speech recognition.Aleem Mushtaq, Yu Tsao, Chin-Hui Lee
2009ASRUMAP estimation of online mapping parameters in ensemble speaker and speaking environment modeling.Yu Tsao, Shigeki Matsuda, Satoshi Nakamura, Chin-Hui Lee
2009ICASSPEnsemble speaker and speaking environment modeling approach with advanced online estimation process.Yu Tsao, Jinyu Li, Chin-Hui Lee
2009InterspeechA study on soft margin estimation of linear regression parameters for speaker adaptation.Shigeki Matsuda, Yu Tsao, Jinyu Li, Satoshi Nakamura, Chin-Hui Lee
2008ICASSPA programmable analog radial-basis-function based classifier.Sheng-Yu Peng, Yu Tsao, Paul E. Hasler, David V. Anderson
2008InterspeechImproving the ensemble speaker and speaking environment modeling approach by enhancing the precision of the online estimation process.Yu Tsao, Chin-Hui Lee
2007ASRUTwo extensions to ensemble speaker and speaking environment modeling for robust automatic speech recognition.Yu Tsao, Chin-Hui Lee
2007InterspeechDetection-based ASR in the automatic speech attribute transcription project.Ilana Bromberg, Qian Qian, Jun Hou, Jinyu Li, Chengyuan Ma, Brett Matthews, Antonio Moreno-Daniel, Jeremy Morris, Sabato Marco Siniscalchi, Yu Tsao, Yu Wang
2007InterspeechAn ensemble modeling approach to joint characterization of speaker and speaking environments.Yu Tsao, Chin-Hui Lee
2006InterspeechA study on detection based automatic speech recognition.Chengyuan Ma, Yu Tsao, Chin-Hui Lee
2006InterspeechA vector space approach to environment modeling for robust speech recognition.Yu Tsao, Chin-Hui Lee
2005ICASSPA Study on Knowledge Source Integration for Candidate Rescoring in Automatic Speech Recognition.Jinyu Li, Yu Tsao, Chin-Hui Lee
2005InterspeechA study on separation between acoustic models and its applications.Yu Tsao, Jinyu Li, Chin-Hui Lee
2001InterspeechSegmental eigenvoice for rapid speaker adaptation.Yu Tsao, Shang-Ming Lee, Fu-Chiang Chou, Lin-Shan Lee