| 2026 | LREC | Efficient Dialect-Aware Modeling and Conditioning for Low-Resource Taiwanese Hakka Speech Processing. | An-Ci Peng, Kuan-Tang Huang, Tien-Hong Lo, Hung-Shin Lee, Hsin-Min Wang, Berlin Chen |
| 2026 | LREC | TG-ASR: Translation-Guided Learning with Parallel Gated Cross Attention for Low-Resource Automatic Speech Recognition. | Cheng-Yeh Yang, Chien-Chun Wang, Li-Wei Chen, Hung-Shin Lee, Hsin-Min Wang, Berlin Chen |
| 2025 | ASRU | Revealing the Role of Audio Channels in ASR Performance Degradation. | Kuan-Tang Huang, Li-Wei Chen, Hung-Shin Lee, Berlin Chen, Hsin-Min Wang |
| 2025 | ASRU | HighRateMOS: Sampling-Rate Aware Modeling for Speech Quality Assessment. | Wenze Ren, Yi-Cheng Lin, Wen-Chin Huang, Ryandhimas E. Zezario, Szu-Wei Fu, Sung-Feng Huang, Erica Cooper, Haibin Wu, Hung-Yu Wei, Hsin-Min Wang, Hung-Yi Lee, Yu Tsao |
| 2025 | ASRU | QAMRO: Quality-aware Adaptive Margin Ranking Optimization for Human-aligned Assessment of Audio Generation Systems. | Chien-Chun Wang, Kuan-Tang Huang, Cheng-Yeh Yang, Hung-Shin Lee, Hsin-Min Wang, Berlin Chen |
| 2025 | ASRU | Improving Perceptual Audio Aesthetic Assessment via Triplet Loss and Self-Supervised Embeddings. | Dyah A. M. G. Wisnu, Ryandhimas E. Zezario, Stefano Rini, Hsin-Min Wang, Yu Tsao |
| 2025 | ICASSP | MSECG: Incorporating Mamba for Robust and Efficient ECG Super-Resolution. | Jie Lin, I Chiu, Kuan-Chen Wang, Kai-Chun Liu, Hsin-Min Wang, Ping-Cheng Yeh, Yu Tsao |
| 2025 | ICASSP | Leveraging Joint Spectral and Spatial Learning with MAMBA for Multichannel Speech Enhancement. | Wenze Ren, Haibin Wu, Yi-Cheng Lin, Xuanjun Chen, Rong Chao, Kuo-Hsuan Hung, You-Jin Li, Wen-Yuan Ting, Hsin-Min Wang, Yu Tsao |
| 2025 | ICASSP | Channel-Aware Domain-Adaptive Generative Adversarial Network for Robust Speech Recognition. | Chien-Chun Wang, Li-Wei Chen, Cheng-Kang Chou, Hung-Shin Lee, Berlin Chen, Hsin-Min Wang |
| 2025 | ICASSP | A Study on Zero-shot Non-intrusive Speech Assessment using Large Language Models. | Ryandhimas E. Zezario, Sabato Marco Siniscalchi, Hsin-Min Wang, Yu Tsao |
| 2025 | Interspeech | A Study on Speech Assessment with Visual Cues. | Shafique Ahmed, Ryandhimas E. Zezario, Nasir Saleem, Amir Hussain, Hsin-Min Wang, Yu Tsao |
| 2025 | Interspeech | A Comparative Study on Proactive and Passive Detection of Deepfake Speech. | Chia-Hua Wu, Wanying Ge, Xin Wang, Junichi Yamagishi, Yu Tsao, Hsin-Min Wang |
| 2025 | Interspeech | Feature Importance across Domains for Improving Non-Intrusive Speech Intelligibility Prediction in Hearing Aids. | Ryandhimas E. Zezario, Sabato Marco Siniscalchi, Fei Chen, Hsin-Min Wang, Yu Tsao |
| 2024 | ICASSP | SpeechCLIP+: Self-Supervised Multi-Task Representation Learning for Speech Via Clip and Speech-Image Data. | Hsuan-Fu Wang, Yi-Jen Shih, Heng-Jui Chang, Layne Berry, Puyuan Peng, Hung-Yi Lee, Hsin-Min Wang, David Harwath |
| 2024 | ICASSP | Multi-Task Pseudo-Label Learning for Non-Intrusive Speech Quality Assessment Model. | Ryandhimas E. Zezario, Bo-Ren Brian Bai, Chiou-Shann Fuh, Hsin-Min Wang, Yu Tsao |
| 2024 | Interspeech | Learnable Layer Selection and Model Fusion for Speech Self-Supervised Learning Models. | Sheng-Chieh Chiu, Chia-Hua Wu, Jih-Kang Hsieh, Yu Tsao, Hsin-Min Wang |
| 2024 | Interspeech | SVSNet+: Enhancing Speaker Voice Similarity Assessment Models with Representations from Speech Foundation Models. | Chun Yin, Tai-Shih Chi, Yu Tsao, Hsin-Min Wang |
| 2024 | Interspeech | Non-Intrusive Speech Intelligibility Prediction for Hearing Aids using Whisper and Metadata. | Ryandhimas E. Zezario, Fei Chen, Chiou-Shann Fuh, Hsin-Min Wang, Yu Tsao |
| 2023 | ASRU | The Voicemos Challenge 2023: Zero-Shot Subjective Speech Quality Prediction for Multiple Domains. | Erica Cooper, Wen-Chin Huang, Yu Tsao, Hsin-Min Wang, Tomoki Toda, Junichi Yamagishi |
| 2023 | ASRU | LC4SV: A Denoising Framework Learning to Compensate for Unseen Speaker Verification Models. | Chi-Chang Lee, Hong-Wei Chen, Chu-Song Chen, Hsin-Min Wang, Tsung-Te Liu, Yu Tsao |
| 2023 | ICLR | D4AM: A General Denoising Framework for Downstream Acoustic Models. | Chi-Chang Lee, Yu Tsao, Hsin-Min Wang, Chu-Song Chen |
| 2023 | Interspeech | Mandarin Electrolaryngeal Speech Voice Conversion using Cross-domain Features. | Hsin-Hao Chen, Yung-Lun Chien, Ming-Chi Yen, Shu-Wei Tsai, Tai-Shih Chi, Hsin-Min Wang, Yu Tsao |
| 2023 | Interspeech | A Training and Inference Strategy Using Noisy and Enhanced Speech as Target for Speech Enhancement without Clean Speech. | Li-Wei Chen, Yao-Fei Cheng, Hung-Shin Lee, Yu Tsao, Hsin-Min Wang |
| 2023 | Interspeech | Audio-Visual Mandarin Electrolaryngeal Speech Voice Conversion. | Yung-Lun Chien, Hsin-Hao Chen, Ming-Chi Yen, Shu-Wei Tsai, Hsin-Min Wang, Yu Tsao, Tai-Shih Chi |
| 2022 | ICASSP | EMGSE: Acoustic/EMG Fusion for Multimodal Speech Enhancement. | Kuan-Chen Wang, Kai-Chun Liu, Hsin-Min Wang, Yu Tsao |
| 2022 | ICASSP | Partially Fake Audio Detection by Self-Attention-Based Fake Span Discovery. | Haibin Wu, Heng-Cheng Kuo, Naijun Zheng, Kuo-Hsuan Hung, Hung-Yi Lee, Yu Tsao, Hsin-Min Wang, Helen Meng |
| 2022 | Interspeech | The VoiceMOS Challenge 2022. | Wen-Chin Huang, Erica Cooper, Yu Tsao, Hsin-Min Wang, Tomoki Toda, Junichi Yamagishi |
| 2022 | Interspeech | Chain-based Discriminative Autoencoders for Speech Recognition. | Hung-Shin Lee, Pin-Tuan Huang, Yao-Fei Cheng, Hsin-Min Wang |
| 2022 | Interspeech | NASTAR: Noise Adaptive Speech Enhancement with Target-Conditional Resampling. | Chi-Chang Lee, Cheng-Hung Hu, Yu-Chen Lin, Chu-Song Chen, Hsin-Min Wang, Yu Tsao |
| 2022 | Interspeech | Disentangling the Impacts of Language and Channel Variability on Speech Separation Networks. | Fan-Lin Wang, Hung-Shin Lee, Yu Tsao, Hsin-Min Wang |
| 2022 | Interspeech | MBI-Net: A Non-Intrusive Multi-Branched Speech Intelligibility Prediction Model for Hearing Aids. | Ryandhimas Edo Zezario, Fei Chen, Chiou-Shann Fuh, Hsin-Min Wang, Yu Tsao |
| 2022 | Interspeech | MTI-Net: A Multi-Target Speech Intelligibility Prediction Model. | Ryandhimas Edo Zezario, Szu-Wei Fu, Fei Chen, Chiou-Shann Fuh, Hsin-Min Wang, Yu Tsao |
| 2021 | ACL | Sequence to General Tree: Knowledge-Guided Geometry Word Problem Solving. | Shih-hung Tsai, Chao-Chun Liang, Hsin-Min Wang, Keh-Yih Su |
| 2021 | ASRU | HASA-Net: A Non-Intrusive Hearing-Aid Speech Assessment Network. | Hsin-Tien Chiang, Yi-Chiao Wu, Cheng Yu, Tomoki Toda, Hsin-Min Wang, Yih-Chun Hu, Yu Tsao |
| 2021 | ASRU | Mandarin Electrolaryngeal Speech Voice Conversion with Sequence-to-Sequence Modeling. | Ming-Chi Yen, Wen-Chin Huang, Kazuhiro Kobayashi, Yu-Huai Peng, Shu-Wei Tsai, Yu Tsao, Tomoki Toda, Jyh-Shing Roger Jang, Hsin-Min Wang |
| 2021 | ICASSP | Speech Recognition by Simply Fine-Tuning Bert. | Wen-Chin Huang, Chia-Hua Wu, Shang-Bao Luo, Kuan-Yu Chen, Hsin-Min Wang, Tomoki Toda |
| 2021 | ICASSP | Melody Harmonization Using Orderless Nade, Chord Balancing, and Blocked Gibbs Sampling. | Chung-En Sun, Yi-Wei Chen, Hung-Shin Lee, Yen-Hsing Chen, Hsin-Min Wang |
| 2021 | Interspeech | AlloST: Low-Resource Speech Translation Without Source Transcription. | Yao-Fei Cheng, Hung-Shin Lee, Hsin-Min Wang |
| 2021 | Interspeech | A Preliminary Study of a Two-Stage Paradigm for Preserving Speaker Identity in Dysarthric Voice Conversion. | Wen-Chin Huang, Kazuhiro Kobayashi, Yu-Huai Peng, Ching-Feng Liu, Yu Tsao, Hsin-Min Wang, Tomoki Toda |
| 2021 | Interspeech | Dual-Path Filter Network: Speaker-Aware Modeling for Speech Separation. | Fan-Lin Wang, Yu-Huai Peng, Hung-Shin Lee, Hsin-Min Wang |
| 2021 | Interspeech | Relational Data Selection for Data Augmentation of Speaker-Dependent Multi-Band MelGAN Vocoder. | Yi-Chiao Wu, Cheng-Hung Hu, Hung-Shin Lee, Yu-Huai Peng, Wen-Chin Huang, Yu Tsao, Hsin-Min Wang, Tomoki Toda |
| 2020 | ICASSP | Statistics Pooling Time Delay Neural Network Based on X-Vector for Speaker Verification. | Qian-Bei Hong, Chung-Hsien Wu, Hsin-Min Wang, Chien-Lin Huang |
| 2020 | ICASSP | Combining Deep Embeddings of Acoustic and Articulatory Features for Speaker Identification. | Qian-Bei Hong, Chung-Hsien Wu, Hsin-Min Wang, Chien-Lin Huang |
| 2020 | ICASSP | Self-Supervised Denoising Autoencoder with Linear Regression Decoder for Speech Enhancement. | Ryandhimas E. Zezario, Tassadaq Hussain, Xugang Lu, Hsin-Min Wang, Yu Tsao |
| 2020 | Interspeech | Lite Audio-Visual Speech Enhancement. | Shang-Yi Chuang, Yu Tsao, Chen-Chou Lo, Hsin-Min Wang |
| 2020 | Interspeech | SERIL: Noise Adaptive Speech Enhancement Using Regularization-Based Incremental Learning. | Chi-Chang Lee, Yu-Chen Lin, Hsuan-Tien Lin, Hsin-Min Wang, Yu Tsao |
| 2019 | ASRU | Spoken Multiple-Choice Question Answering Using Multimodal Convolutional Neural Networks. | Shang-Bao Luo, Hung-Shin Lee, Kuan-Yu Chen, Hsin-Min Wang |
| 2019 | ICASSP | Reinforcement Learning Based Speech Enhancement for Robust Speech Recognition. | Yih-Liang Shen, Chao-Yuan Huang, Syu-Siang Wang, Yu Tsao, Hsin-Min Wang, Tai-Shih Chi |
| 2019 | Interspeech | Exploring the Encoder Layers of Discriminative Autoencoders for LVCSR. | Pin-Tuan Huang, Hung-Shin Lee, Syu-Siang Wang, Kuan-Yu Chen, Yu Tsao, Hsin-Min Wang |
| 2019 | Interspeech | Investigation of F0 Conditioning and Fully Convolutional Networks in Variational Autoencoder Based Voice Conversion. | Wen-Chin Huang, Yi-Chiao Wu, Chen-Chou Lo, Patrick Lumban Tobing, Tomoki Hayashi, Kazuhiro Kobayashi, Tomoki Toda, Yu Tsao, Hsin-Min Wang |
| 2019 | Interspeech | Noise Adaptive Speech Enhancement Using Domain Adversarial Training. | Chien-Feng Liao, Yu Tsao, Hung-yi Lee, Hsin-Min Wang |
| 2019 | Interspeech | MOSNet: Deep Learning-Based Objective Assessment for Voice Conversion. | Chen-Chou Lo, Szu-Wei Fu, Wen-Chin Huang, Xin Wang, Junichi Yamagishi, Yu Tsao, Hsin-Min Wang |
| 2019 | Interspeech | Specialized Speech Enhancement Model Selection Based on Learned Non-Intrusive Quality Assessment Metric. | Ryandhimas E. Zezario, Szu-Wei Fu, Xugang Lu, Hsin-Min Wang, Yu Tsao |
| 2018 | ICASSP | Essence Vector-Based Query Modeling for Spoken Document Retrieval. | Kuan-Yu Chen, Shih-Hung Liu, Berlin Chen, Hsin-Min Wang |
| 2018 | Interspeech | Quality-Net: An End-to-End Non-intrusive Speech Quality Assessment Model Based on BLSTM. | Szu-Wei Fu, Yu Tsao, Hsin-Te Hwang, Hsin-Min Wang |
| 2018 | Interspeech | Exemplar-Based Spectral Detail Compensation for Voice Conversion. | Yu-Huai Peng, Hsin-Te Hwang, Yi-Chiao Wu, Yu Tsao, Hsin-Min Wang |
| 2017 | ASRU | Neural relevance-aware query modeling for spoken document retrieval. | Tien-Hong Lo, Ying-Wen Chen, Kuan-Yu Chen, Hsin-Min Wang, Berlin Chen |
| 2017 | ICASSP | A locality-preserving essence vector modeling framework for spoken document retrieval. | Kuan-Yu Chen, Shih-Hung Liu, Berlin Chen, Hsin-Min Wang |
| 2017 | ICASSP | Discriminative autoencoders for speaker verification. | Hung-Shin Lee, Yu-Ding Lu, Chin-Cheng Hsu, Yu Tsao, Hsin-Min Wang, Shyh-Kang Jeng |
| 2017 | ICASSP | Leveraging manifold learning for extractive broadcast news summarization. | Shih-Hung Liu, Kuan-Yu Chen, Berlin Chen, Hsin-Min Wang, Wen-Lian Hsu |
| 2017 | ICASSP | Speech emotion recognition with skew-robust neural networks. | Po-Yuan Shih, Chia-Ping Chen, Hsin-Min Wang |
| 2017 | ICASSP | Deep-net fusion to classify shots in concert videos. | Wen-Li Wei, Jen-Chun Lin, Tyng-Luh Liu, Yi-Hsuan Yang, Hsin-Min Wang, Hsiao-Rong Tyan, Hong-Yuan Mark Liao |
| 2017 | ICASSP | A locally linear embbeding based postfiltering approach for speech enhancement. | Yi-Chiao Wu, Hsin-Te Hwang, Syu-Siang Wang, Chin-Cheng Hsu, Ying-Hui Lai, Yu Tsao, Hsin-Min Wang |
| 2017 | Interspeech | Exploring the Use of Significant Words Language Modeling for Spoken Document Retrieval. | Ying-Wen Chen, Kuan-Yu Chen, Hsin-Min Wang, Berlin Chen |
| 2017 | Interspeech | Voice Conversion from Unaligned Corpora Using Variational Autoencoding Wasserstein Generative Adversarial Networks. | Chin-Cheng Hsu, Hsin-Te Hwang, Yi-Chiao Wu, Yu Tsao, Hsin-Min Wang |
| 2017 | Interspeech | Wavelet Speech Enhancement Based on Robust Principal Component Analysis. | Chia-Lung Wu, Hsiang-Ping Hsu, Syu-Siang Wang, Jeih-Weih Hung, Ying-Hui Lai, Hsin-Min Wang, Yu Tsao |
| 2017 | Interspeech | A Post-Filtering Approach Based on Locally Linear Embedding Difference Compensation for Speech Enhancement. | Yi-Chiao Wu, Hsin-Te Hwang, Syu-Siang Wang, Chin-Cheng Hsu, Yu Tsao, Hsin-Min Wang |
| 2017 | Interspeech | Discriminative Autoencoders for Acoustic Modeling. | Ming-Han Yang, Hung-Shin Lee, Yu-Ding Lu, Kuan-Yu Chen, Yu Tsao, Berlin Chen, Hsin-Min Wang |
| 2016 | COLING | Learning to Distill: The Essence Vector Modeling Framework. | Kuan-Yu Chen, Shih-Hung Liu, Berlin Chen, Hsin-Min Wang |
| 2016 | ICASSP | Improved spoken document summarization with coverage modeling techniques. | Kuan-Yu Chen, Shih-Hung Liu, Berlin Chen, Hsin-Min Wang |
| 2016 | ICASSP | DEMV-matchmaker: Emotional temporal course representation and deep similarity matching for automatic music video generation. | Jen-Chun Lin, Wen-Li Wei, Hsin-Min Wang |
| 2016 | Interspeech | Minimization of Regression and Ranking Losses with Shallow Neural Networks on Automatic Sincerity Evaluation. | Hung-Shin Lee, Yu Tsao, Chi-Chun Lee, Hsin-Min Wang, Wei-Cheng Lin, Wei-Chen Chen, Shan-Wen Hsiao, Shyh-Kang Jeng |
| 2016 | Interspeech | Exploring Word Mover's Distance and Semantic-Aware Embedding Techniques for Extractive Broadcast News Summarization. | Shih-Hung Liu, Kuan-Yu Chen, Yu-Lun Hsieh, Berlin Chen, Hsin-Min Wang, Hsu-Chun Yen, Wen-Lian Hsu |
| 2016 | Interspeech | Locally Linear Embedding for Exemplar-Based Spectral Conversion. | Yi-Chiao Wu, Hsin-Te Hwang, Chin-Cheng Hsu, Yu Tsao, Hsin-Min Wang |
| 2015 | ASRU | Incorporating paragraph embeddings and density peaks clustering for spoken document summarization. | Kuan-Yu Chen, Kai-Wun Shih, Shih-Hung Liu, Berlin Chen, Hsin-Min Wang |
| 2015 | ICASSP | I-vector based language modeling for query representation. | Kuan-Yu Chen, Hsin-Min Wang, Berlin Chen, Hsin-Hsi Chen |
| 2015 | ICASSP | A histogram density modeling approach to music emotion recognition. | Ju-Chiang Wang, Hsin-Min Wang, Gert R. G. Lanckriet |
| 2015 | Interspeech | Leveraging word embeddings for spoken document summarization. | Kuan-Yu Chen, Shih-Hung Liu, Hsin-Min Wang, Berlin Chen, Hsin-Hsi Chen |
| 2015 | Interspeech | Positional language modeling for extractive broadcast news speech summarization. | Shih-Hung Liu, Kuan-Yu Chen, Berlin Chen, Hsin-Min Wang, Hsu-Chun Yen, Wen-Lian Hsu |
| 2014 | EMNLP | Leveraging Effective Query Modeling Techniques for Speech Recognition and Summarization. | Kuan-Yu Chen, Shih-Hung Liu, Berlin Chen, Ea-Ee Jan, Hsin-Min Wang, Wen-Lian Hsu, Hsin-Hsi Chen |
| 2014 | ICASSP | I-vector based language modeling for spoken document retrieval. | Kuan-Yu Chen, Hung-Shin Lee, Hsin-Min Wang, Berlin Chen, Hsin-Hsi Chen |
| 2014 | ICASSP | Speaker verification using kernel-based binary classifiers with binary operation derived features. | Hung-Shin Lee, Yu Tso, Yun-Fan Chang, Hsin-Min Wang, Shyh-Kang Jeng |
| 2014 | ICASSP | Effective pseudo-relevance feedback for language modeling in extractive speech summarization. | Shih-Hung Liu, Kuan-Yu Chen, Yu-Lun Hsieh, Berlin Chen, Hsin-Min Wang, Hsu-Chun Yen, Wen-Lian Hsu |
| 2014 | ICASSP | Improving music auto-tagging by intra-song instance bagging. | Chin-Chia Michael Yeh, Ju-Chiang Wang, Yi-Hsuan Yang, Hsin-Min Wang |
| 2014 | Interspeech | Ensemble of machine learning algorithms for cognitive and physical speaker load detection. | How Jing, Ting-Yao Hu, Hung-Shin Lee, Wei-Chen Chen, Chi-Chun Lee, Yu Tsao, Hsin-Min Wang |
| 2014 | Interspeech | Clustering-based i-vector formulation for speaker recognition. | Hung-Shin Lee, Yu Tsao, Hsin-Min Wang, Shyh-Kang Jeng |
| 2014 | Interspeech | Enhanced language modeling for extractive speech summarization with sentence relatedness information. | Shih-Hung Liu, Kuan-Yu Chen, Yu-Lun Hsieh, Berlin Chen, Hsin-Min Wang, Hsu-Chun Yen, Wen-Lian Hsu |
| 2013 | ICASSP | Effective pseudo-relevance feedback for spoken document retrieval. | Yi-Wen Chen, Kuan-Yu Chen, Hsin-Min Wang, Berlin Chen |
| 2013 | ICASSP | Weighted matrix factorization for spoken document retrieval. | Kuan-Yu Chen, Hsin-Min Wang, Berlin Chen, Hsin-Hsi Chen |
| 2013 | ICASSP | Subspace-based phonotactic language recognition using multivariate dynamic linear models. | Hung-Shin Lee, Yu-Chin Shih, Hsin-Min Wang, Shyh-Kang Jeng |
| 2013 | IJCNLP | Semantic Nave Bayes Classifier for Document Classification. | How Jing, Yu Tsao, Kuan-Yu Chen, Hsin-Min Wang |
| 2013 | Interspeech | Alleviating the over-smoothing problem in GMM-based voice conversion with discriminative training. | Hsin-Te Hwang, Yu Tsao, Hsin-Min Wang, Yih-Ru Wang, Sin-Horng Chen |
| 2013 | PAKDD | Query-Document Relevance Topic Models. | Meng-Sung Wu, Chia-Ping Chen, Hsin-Min Wang |
| 2012 | ICASSP | Generalized k-labelset ensemble for multi-label classification. | Hung-Yi Lo, Shou-De Lin, Hsin-Min Wang |
| 2012 | ICASSP | Playing with tagging: A real-time tagging music player. | Ju-Chiang Wang, Hsin-Min Wang, Shyh-Kang Jeng |
| 2012 | ICPR | Term relevance dependency model for text classification. | Meng-Sung Wu, Hsin-Min Wang |
| 2012 | Interspeech | Word Relevance Modeling for Speech Recognition. | Kuan-Yu Chen, Hao-Chin Chang, Berlin Chen, Hsin-Min Wang |
| 2012 | Interspeech | A Study of Mutual Information for GMM-Based Spectral Conversion. | Hsin-Te Hwang, Yu Tsao, Hsin-Min Wang, Yih-Ru Wang, Sin-Horng Chen |
| 2012 | Interspeech | Subspace-Based Feature Representation and Learning for Language Recognition. | Yu-Chin Shih, Hung-Shin Lee, Hsin-Min Wang, Shyh-Kang Jeng |
| 2012 | PAKDD | A Term Association Translation Model for Naive Bayes Text Classification. | Meng-Sung Wu, Hsin-Min Wang |
| 2011 | ICASSP | Cost-sensitive stacking for audio tag annotation and retrieval. | Hung-Yi Lo, Ju-Chiang Wang, Hsin-Min Wang, Shou-De Lin |
| 2011 | MMM | Audio Tag Annotation and Retrieval Using Tag Count Information. | Hung-Yi Lo, Shou-De Lin, Hsin-Min Wang |
| 2010 | ICASSP | Background music identification through content filtering and min-hash matching. | Chih-Yi Chiu, Dimitrios Bountouridis, Ju-Chiang Wang, Hsin-Min Wang |
| 2010 | ICIP | Detecting pitching frames in baseball game video using Markov random walk. | Chih-Yi Chiu, Po-Chih Lin, Wei-Ming Chang, Hsin-Min Wang, Shi-Nine Yang |
| 2010 | ICPR | A Discriminative and Heteroscedastic Linear Feature Transformation for Multiclass Classification. | Hung-Shin Lee, Hsin-Min Wang, Berlin Chen |
| 2010 | Interspeech | Phonetic subspace mixture model for speaker diarization. | I-Fan Chen, Shih-Sian Cheng, Hsin-Min Wang |
| 2010 | Interspeech | Bayesian speaker recognition using Gaussian mixture model and laplace approximation. | Shih-Sian Cheng, I-Fan Chen, Hsin-Min Wang |
| 2009 | CIKM | Learning to rank from Bayesian decision inference. | Jen-Wei Kuo, Pu-Jen Cheng, Hsin-Min Wang |
| 2009 | Interspeech | Speaker diarization using divide-and-conquer. | Shih-Sian Cheng, Chun-Han Tseng, Chia-Ping Chen, Hsin-Min Wang |
| 2009 | Interspeech | Articulatory feature asynchrony analysis and compensation in detection-based ASR. | I-Fan Chen, Hsin-Min Wang |
| 2008 | ICASSP | BIC-based audio segmentation by divide-and-conquer. | Shih-Sian Cheng, Hsin-Min Wang, Hsin-Chia Fu |
| 2008 | ICASSP | A comparative study of probabilistic ranking models for spoken document summarization. | Shih-Hsiang Lin, Yi-Ting Chen, Hsin-Min Wang, Bin Chen |
| 2007 | ASRU | Spoken document summarization using relevant information. | Yi-Ting Chen, Shih-Hsiang Lin, Hsin-Min Wang, Berlin Chen |
| 2007 | ICASSP | Improved Methods for Characterizing the Alternative Hypothesis using Minimum Verification Error Training for LLR-Based Speaker Verification. | Yi-Hsiang Chao, Wei-Ho Tsai, Hsin-Min Wang, Ruei-Chuan Chang |
| 2007 | ICASSP | Phonetic Boundary Refinement using Support Vector Machine. | Hung-Yi Lo, Hsin-Min Wang |
| 2007 | ICASSP | Speaker Clustering Based on Minimum Rand Index. | Wei-Ho Tsai, Hsin-Min Wang |
| 2007 | Interspeech | Evolutionary minimum verification error learning of the alternative hypothesis model for LLR-based speaker verification. | Yi-Hsiang Chao, Wei-Ho Tsai, Shih-Sian Cheng, Hsin-Min Wang, Ruei-Chuan Chang |
| 2007 | Interspeech | A unified probabilistic generative framework for extractive spoken document summarization. | Yi-Ting Chen, Hsuan-Sheng Chiu, Hsin-Min Wang, Berlin Chen |
| 2007 | Interspeech | Improved HMM/SVM methods for automatic phoneme segmentation. | Jen-Wei Kuo, Hung-Yi Lo, Hsin-Min Wang |
| 2006 | ICASSP | On Maximizing the Within-Cluster Homogeneity of Speaker Voice Characteristics For Speech Utterance Clustering. | Wei-Ho Tsai, Hsin-Min Wang |
| 2006 | ICPR | A Kernel-based Discrimination Framework for Solving Hypothesis Testing Problems with Application to Speaker Verification. | Yi-Hsiang Chao, Wei-Ho Tsai, Hsin-Min Wang, Ruei-Chuan Chang |
| 2006 | ICPR | A Prototypes-Embedded Genetic K-means Algorithm. | Shih-Sian Cheng, Yi-Hsiang Chao, Hsin-Min Wang, Hsin-Chia Fu |
| 2006 | Interspeech | Improving the characterization of the alternative hypothesis via kernel discriminant analysis for likelihood ratio-based speaker verification. | Yi-Hsiang Chao, Wei-Ho Tsai, Hsin-Min Wang, Ruei-Chuan Chang |
| 2006 | Interspeech | Minimum boundary error training for automatic phonetic segmentation. | Jen-Wei Kuo, Hsin-Min Wang |
| 2005 | ICASSP | Gmm-Based Bhattacharyya Kernel Fisher Discriminant Analysis For Speaker Recognition. | Yi-Hsiang Chao, Hsin-Min Wang, Ruei-Chuan Chang |
| 2005 | ICASSP | Clustering Speech Utterances by Speaker Using Eigenvoice-Motivated Vector Space Models. | Wei-Ho Tsai, Shih-Sian Cheng, Yi-Hsiang Chao, Hsin-Min Wang |
| 2005 | Interspeech | Speaker clustering of unknown utterances based on maximum purity estimation. | Wei-Ho Tsai, Hsin-Min Wang |
| 2004 | ICASSP | Automatic detection and tracking of target singer in multi-singer music recordings. | Wei-Ho Tsai, Hsin-Min Wang |
| 2004 | Interspeech | Statistical Chinese spoken document retrieval using latent topical information. | Jen-Wei Kuo, Yao-Min Huang, Berlin Chen, Hsin-Min Wang |
| 2004 | Interspeech | Speaker clustering of speech utterances using a voice characteristic reference space. | Wei-Ho Tsai, Shih-Sian Cheng, Hsin-Min Wang |
| 2004 | Interspeech | METRIC-SEQDAC: a hybrid approach for audio segmentation. | Hsin-Min Wang, Shih-Sian Cheng |
| 2003 | Interspeech | A sequential metric-based audio segmentation method via the Bayesian information criterion. | Shih-Sian Cheng, Hsin-Min Wang |
| 2003 | Interspeech | Multi-scale document expansion in English-Mandarin cross-language spoken document retrieval. | Wai Kit Lo, Yuk-Chi Li, Gina-Anne Levow, Hsin-Min Wang, Helen M. Meng |
| 2003 | Interspeech | Automatic singer identification of popular music recordings via estimation and modeling of solo vocal signal. | Wei-Ho Tsai, Hsin-Min Wang, Dwight Rodgers |
| 2001 | ICASSP | Eigenspace-based maximum a posteriori linear regression for rapid speaker adaptation. | Kuan-Ting Chen, Hsin-Min Wang |
| 2001 | ICASSP | Multi-scale-audio indexing for translingual spoken document retrieval. | Hsin-Min Wang, Helen M. Meng, Patrick Schone, Berlin Chen, Wai-Kit Lo |
| 2001 | Interspeech | Improved spoken document retrieval by exploring extra acoustic and linguistic cues. | Berlin Chen, Hsin-Min Wang, Lin-Shan Lee |
| 2001 | Interspeech | An HMM/n-gram-based linguistic processing approach for Mandarin spoken document retrieval. | Berlin Chen, Hsin-Min Wang, Lin-Shan Lee |
| 2001 | Interspeech | Comparative analysis for data-driven temporal filters obtained via principal component analysis (PCA) and linear discriminant analysis (LDA) in speech recognition. | Jeih-Weih Hung, Hsin-Min Wang, Lin-Shan Lee |
| 2001 | NAACL | Mandarin-English Information: Investigating Translingual Speech Retrieval. | Helen M. Meng, Berlin Chen, Sanjeev Khudanpur, Gina-Anne Levow, Wai-Kit Lo, Douglas W. Oard, Patrick Schone, Karen Tang, Hsin-Min Wang, Jianqiang Wang |
| 2000 | ICASSP | Retrieval of broadcast news speech in Mandarin Chinese collected in Taiwan using syllable-level statistical characteristics. | Berlin Chen, Hsin-Min Wang, Lin-Shan Lee |
| 2000 | Interspeech | Fast speaker adaptation using eigenspace-based maximum likelihood linear regression. | Kuan-Ting Chen, Wen-Wei Liau, Hsin-Min Wang, Lin-Shan Lee |
| 2000 | Interspeech | Retrieval of mandarin broadcast news using spoken queries. | Berlin Chen, Hsin-Min Wang, Lin-Shan Lee |
| 2000 | Interspeech | Automatic metric-based speech segmentation for broadcast news via principal component analysis. | Jeih-Weih Hung, Hsin-Min Wang, Lin-Shan Lee |
| 1999 | Interspeech | Consistent dialogue across concurrent topics based on an expert system model. | Bor-Shen Lin, Hsin-Min Wang, Lin-Shan Lee |
| 1998 | Interspeech | A*-admissible key-phrase spotting with sub-syllable level utterance verification. | Berlin Chen, Hsin-Min Wang, Lee-Feng Chien, Lin-Shan Lee |
| 1998 | Interspeech | Hierarchical tag-graph search for spontaneous speech understanding in spoken dialog systems. | Bor-Shen Lin, Berlin Chen, Hsin-Min Wang, Lin-Shan Lee |
| 1998 | Interspeech | Towards a Mandarin voice memo system. | Hsin-Min Wang, Bor-Shen Lin, Berlin Chen, Bo-Ren Bai |
| 1997 | ICASSP | Internet Chinese information retrieval using unconstrained Mandarin speech queries based on a client-server architecture and a PAT-tree-based language model. | Lee-Feng Chien, Sung-Chien Lin, Jenn-Chau Hong, Ming-Chiuan Chen, Hsin-Min Wang, Jia-Lin Shen, Keh-Jiann Chen, Lin-Shan Lee |
| 1995 | ICASSP | Complete recognition of continuous Mandarin speech for Chinese language with very large vocabulary but limited training data. | Hsin-Min Wang, Jia-Lin Shen, Yen-Ju Yang, Chiu-yu Tseng, Lin-Shan Lee |
| 1995 | Interspeech | Fast and accurate continuous speech recognition for Chinese language with very large vocabulary. | Tai-Hsuan Ho, Hsin-Min Wang, Lee-Feng Chien, Keh-Jiann Chen, Lin-Shan Lee |
| 1994 | ICASSP | An initial study on a segmental probability model approach to large-vocabulary continuous Mandarin speech recognition. | Jia-Lin Shen, Hsin-Min Wang, Bo-Ren Bai, Lin-Shan Lee |
| 1994 | Interspeech | Incremental speaker adaptation using phonetically balanced training sentences for Mandarin syllable recognition based on segmental probability models. | Jia-Lin Shen, Hsin-Min Wang, Ren-Yuan Lyu, Lin-Shan Lee |
| 1993 | ICASSP | Golden Mandarin (II)-an improved single-chip real-time Mandarin dictation machine for Chinese language with very large vocabulary. | Lin-Shan Lee, Chiu-yu Tseng, Keh-Jiann Chen, I-Jung Hung, Ming-Yu Lee, Lee-Feng Chien, Yumin Lee, Ren-Yuan Lyu, Hsin-Min Wang, Yung-Chuan Wu, Tung-Sheng Lin, Hung-Yan Gu, Chi-ping Nee, Chun-Yi Liao, Yeng-Ju Yang, Yuan-Cheng Chang, Rung-Chiung Yang |