Skip to content

Hsin-Min Wang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

154

Venues

15

Active years

1993–2026

Best venue rank

A*

Where they publish

Papers

154 indexed papers, newest first.

YearVenueTitleAuthors
2026LRECEfficient Dialect-Aware Modeling and Conditioning for Low-Resource Taiwanese Hakka Speech Processing.An-Ci Peng, Kuan-Tang Huang, Tien-Hong Lo, Hung-Shin Lee, Hsin-Min Wang, Berlin Chen
2026LRECTG-ASR: Translation-Guided Learning with Parallel Gated Cross Attention for Low-Resource Automatic Speech Recognition.Cheng-Yeh Yang, Chien-Chun Wang, Li-Wei Chen, Hung-Shin Lee, Hsin-Min Wang, Berlin Chen
2025ASRURevealing the Role of Audio Channels in ASR Performance Degradation.Kuan-Tang Huang, Li-Wei Chen, Hung-Shin Lee, Berlin Chen, Hsin-Min Wang
2025ASRUHighRateMOS: Sampling-Rate Aware Modeling for Speech Quality Assessment.Wenze Ren, Yi-Cheng Lin, Wen-Chin Huang, Ryandhimas E. Zezario, Szu-Wei Fu, Sung-Feng Huang, Erica Cooper, Haibin Wu, Hung-Yu Wei, Hsin-Min Wang, Hung-Yi Lee, Yu Tsao
2025ASRUQAMRO: Quality-aware Adaptive Margin Ranking Optimization for Human-aligned Assessment of Audio Generation Systems.Chien-Chun Wang, Kuan-Tang Huang, Cheng-Yeh Yang, Hung-Shin Lee, Hsin-Min Wang, Berlin Chen
2025ASRUImproving Perceptual Audio Aesthetic Assessment via Triplet Loss and Self-Supervised Embeddings.Dyah A. M. G. Wisnu, Ryandhimas E. Zezario, Stefano Rini, Hsin-Min Wang, Yu Tsao
2025ICASSPMSECG: Incorporating Mamba for Robust and Efficient ECG Super-Resolution.Jie Lin, I Chiu, Kuan-Chen Wang, Kai-Chun Liu, Hsin-Min Wang, Ping-Cheng Yeh, Yu Tsao
2025ICASSPLeveraging Joint Spectral and Spatial Learning with MAMBA for Multichannel Speech Enhancement.Wenze Ren, Haibin Wu, Yi-Cheng Lin, Xuanjun Chen, Rong Chao, Kuo-Hsuan Hung, You-Jin Li, Wen-Yuan Ting, Hsin-Min Wang, Yu Tsao
2025ICASSPChannel-Aware Domain-Adaptive Generative Adversarial Network for Robust Speech Recognition.Chien-Chun Wang, Li-Wei Chen, Cheng-Kang Chou, Hung-Shin Lee, Berlin Chen, Hsin-Min Wang
2025ICASSPA Study on Zero-shot Non-intrusive Speech Assessment using Large Language Models.Ryandhimas E. Zezario, Sabato Marco Siniscalchi, Hsin-Min Wang, Yu Tsao
2025InterspeechA Study on Speech Assessment with Visual Cues.Shafique Ahmed, Ryandhimas E. Zezario, Nasir Saleem, Amir Hussain, Hsin-Min Wang, Yu Tsao
2025InterspeechA Comparative Study on Proactive and Passive Detection of Deepfake Speech.Chia-Hua Wu, Wanying Ge, Xin Wang, Junichi Yamagishi, Yu Tsao, Hsin-Min Wang
2025InterspeechFeature Importance across Domains for Improving Non-Intrusive Speech Intelligibility Prediction in Hearing Aids.Ryandhimas E. Zezario, Sabato Marco Siniscalchi, Fei Chen, Hsin-Min Wang, Yu Tsao
2024ICASSPSpeechCLIP+: Self-Supervised Multi-Task Representation Learning for Speech Via Clip and Speech-Image Data.Hsuan-Fu Wang, Yi-Jen Shih, Heng-Jui Chang, Layne Berry, Puyuan Peng, Hung-Yi Lee, Hsin-Min Wang, David Harwath
2024ICASSPMulti-Task Pseudo-Label Learning for Non-Intrusive Speech Quality Assessment Model.Ryandhimas E. Zezario, Bo-Ren Brian Bai, Chiou-Shann Fuh, Hsin-Min Wang, Yu Tsao
2024InterspeechLearnable Layer Selection and Model Fusion for Speech Self-Supervised Learning Models.Sheng-Chieh Chiu, Chia-Hua Wu, Jih-Kang Hsieh, Yu Tsao, Hsin-Min Wang
2024InterspeechSVSNet+: Enhancing Speaker Voice Similarity Assessment Models with Representations from Speech Foundation Models.Chun Yin, Tai-Shih Chi, Yu Tsao, Hsin-Min Wang
2024InterspeechNon-Intrusive Speech Intelligibility Prediction for Hearing Aids using Whisper and Metadata.Ryandhimas E. Zezario, Fei Chen, Chiou-Shann Fuh, Hsin-Min Wang, Yu Tsao
2023ASRUThe Voicemos Challenge 2023: Zero-Shot Subjective Speech Quality Prediction for Multiple Domains.Erica Cooper, Wen-Chin Huang, Yu Tsao, Hsin-Min Wang, Tomoki Toda, Junichi Yamagishi
2023ASRULC4SV: A Denoising Framework Learning to Compensate for Unseen Speaker Verification Models.Chi-Chang Lee, Hong-Wei Chen, Chu-Song Chen, Hsin-Min Wang, Tsung-Te Liu, Yu Tsao
2023ICLRD4AM: A General Denoising Framework for Downstream Acoustic Models.Chi-Chang Lee, Yu Tsao, Hsin-Min Wang, Chu-Song Chen
2023InterspeechMandarin Electrolaryngeal Speech Voice Conversion using Cross-domain Features.Hsin-Hao Chen, Yung-Lun Chien, Ming-Chi Yen, Shu-Wei Tsai, Tai-Shih Chi, Hsin-Min Wang, Yu Tsao
2023InterspeechA Training and Inference Strategy Using Noisy and Enhanced Speech as Target for Speech Enhancement without Clean Speech.Li-Wei Chen, Yao-Fei Cheng, Hung-Shin Lee, Yu Tsao, Hsin-Min Wang
2023InterspeechAudio-Visual Mandarin Electrolaryngeal Speech Voice Conversion.Yung-Lun Chien, Hsin-Hao Chen, Ming-Chi Yen, Shu-Wei Tsai, Hsin-Min Wang, Yu Tsao, Tai-Shih Chi
2022ICASSPEMGSE: Acoustic/EMG Fusion for Multimodal Speech Enhancement.Kuan-Chen Wang, Kai-Chun Liu, Hsin-Min Wang, Yu Tsao
2022ICASSPPartially Fake Audio Detection by Self-Attention-Based Fake Span Discovery.Haibin Wu, Heng-Cheng Kuo, Naijun Zheng, Kuo-Hsuan Hung, Hung-Yi Lee, Yu Tsao, Hsin-Min Wang, Helen Meng
2022InterspeechThe VoiceMOS Challenge 2022.Wen-Chin Huang, Erica Cooper, Yu Tsao, Hsin-Min Wang, Tomoki Toda, Junichi Yamagishi
2022InterspeechChain-based Discriminative Autoencoders for Speech Recognition.Hung-Shin Lee, Pin-Tuan Huang, Yao-Fei Cheng, Hsin-Min Wang
2022InterspeechNASTAR: Noise Adaptive Speech Enhancement with Target-Conditional Resampling.Chi-Chang Lee, Cheng-Hung Hu, Yu-Chen Lin, Chu-Song Chen, Hsin-Min Wang, Yu Tsao
2022InterspeechDisentangling the Impacts of Language and Channel Variability on Speech Separation Networks.Fan-Lin Wang, Hung-Shin Lee, Yu Tsao, Hsin-Min Wang
2022InterspeechMBI-Net: A Non-Intrusive Multi-Branched Speech Intelligibility Prediction Model for Hearing Aids.Ryandhimas Edo Zezario, Fei Chen, Chiou-Shann Fuh, Hsin-Min Wang, Yu Tsao
2022InterspeechMTI-Net: A Multi-Target Speech Intelligibility Prediction Model.Ryandhimas Edo Zezario, Szu-Wei Fu, Fei Chen, Chiou-Shann Fuh, Hsin-Min Wang, Yu Tsao
2021ACLSequence to General Tree: Knowledge-Guided Geometry Word Problem Solving.Shih-hung Tsai, Chao-Chun Liang, Hsin-Min Wang, Keh-Yih Su
2021ASRUHASA-Net: A Non-Intrusive Hearing-Aid Speech Assessment Network.Hsin-Tien Chiang, Yi-Chiao Wu, Cheng Yu, Tomoki Toda, Hsin-Min Wang, Yih-Chun Hu, Yu Tsao
2021ASRUMandarin Electrolaryngeal Speech Voice Conversion with Sequence-to-Sequence Modeling.Ming-Chi Yen, Wen-Chin Huang, Kazuhiro Kobayashi, Yu-Huai Peng, Shu-Wei Tsai, Yu Tsao, Tomoki Toda, Jyh-Shing Roger Jang, Hsin-Min Wang
2021ICASSPSpeech Recognition by Simply Fine-Tuning Bert.Wen-Chin Huang, Chia-Hua Wu, Shang-Bao Luo, Kuan-Yu Chen, Hsin-Min Wang, Tomoki Toda
2021ICASSPMelody Harmonization Using Orderless Nade, Chord Balancing, and Blocked Gibbs Sampling.Chung-En Sun, Yi-Wei Chen, Hung-Shin Lee, Yen-Hsing Chen, Hsin-Min Wang
2021InterspeechAlloST: Low-Resource Speech Translation Without Source Transcription.Yao-Fei Cheng, Hung-Shin Lee, Hsin-Min Wang
2021InterspeechA Preliminary Study of a Two-Stage Paradigm for Preserving Speaker Identity in Dysarthric Voice Conversion.Wen-Chin Huang, Kazuhiro Kobayashi, Yu-Huai Peng, Ching-Feng Liu, Yu Tsao, Hsin-Min Wang, Tomoki Toda
2021InterspeechDual-Path Filter Network: Speaker-Aware Modeling for Speech Separation.Fan-Lin Wang, Yu-Huai Peng, Hung-Shin Lee, Hsin-Min Wang
2021InterspeechRelational Data Selection for Data Augmentation of Speaker-Dependent Multi-Band MelGAN Vocoder.Yi-Chiao Wu, Cheng-Hung Hu, Hung-Shin Lee, Yu-Huai Peng, Wen-Chin Huang, Yu Tsao, Hsin-Min Wang, Tomoki Toda
2020ICASSPStatistics Pooling Time Delay Neural Network Based on X-Vector for Speaker Verification.Qian-Bei Hong, Chung-Hsien Wu, Hsin-Min Wang, Chien-Lin Huang
2020ICASSPCombining Deep Embeddings of Acoustic and Articulatory Features for Speaker Identification.Qian-Bei Hong, Chung-Hsien Wu, Hsin-Min Wang, Chien-Lin Huang
2020ICASSPSelf-Supervised Denoising Autoencoder with Linear Regression Decoder for Speech Enhancement.Ryandhimas E. Zezario, Tassadaq Hussain, Xugang Lu, Hsin-Min Wang, Yu Tsao
2020InterspeechLite Audio-Visual Speech Enhancement.Shang-Yi Chuang, Yu Tsao, Chen-Chou Lo, Hsin-Min Wang
2020InterspeechSERIL: Noise Adaptive Speech Enhancement Using Regularization-Based Incremental Learning.Chi-Chang Lee, Yu-Chen Lin, Hsuan-Tien Lin, Hsin-Min Wang, Yu Tsao
2019ASRUSpoken Multiple-Choice Question Answering Using Multimodal Convolutional Neural Networks.Shang-Bao Luo, Hung-Shin Lee, Kuan-Yu Chen, Hsin-Min Wang
2019ICASSPReinforcement Learning Based Speech Enhancement for Robust Speech Recognition.Yih-Liang Shen, Chao-Yuan Huang, Syu-Siang Wang, Yu Tsao, Hsin-Min Wang, Tai-Shih Chi
2019InterspeechExploring the Encoder Layers of Discriminative Autoencoders for LVCSR.Pin-Tuan Huang, Hung-Shin Lee, Syu-Siang Wang, Kuan-Yu Chen, Yu Tsao, Hsin-Min Wang
2019InterspeechInvestigation of F0 Conditioning and Fully Convolutional Networks in Variational Autoencoder Based Voice Conversion.Wen-Chin Huang, Yi-Chiao Wu, Chen-Chou Lo, Patrick Lumban Tobing, Tomoki Hayashi, Kazuhiro Kobayashi, Tomoki Toda, Yu Tsao, Hsin-Min Wang
2019InterspeechNoise Adaptive Speech Enhancement Using Domain Adversarial Training.Chien-Feng Liao, Yu Tsao, Hung-yi Lee, Hsin-Min Wang
2019InterspeechMOSNet: Deep Learning-Based Objective Assessment for Voice Conversion.Chen-Chou Lo, Szu-Wei Fu, Wen-Chin Huang, Xin Wang, Junichi Yamagishi, Yu Tsao, Hsin-Min Wang
2019InterspeechSpecialized Speech Enhancement Model Selection Based on Learned Non-Intrusive Quality Assessment Metric.Ryandhimas E. Zezario, Szu-Wei Fu, Xugang Lu, Hsin-Min Wang, Yu Tsao
2018ICASSPEssence Vector-Based Query Modeling for Spoken Document Retrieval.Kuan-Yu Chen, Shih-Hung Liu, Berlin Chen, Hsin-Min Wang
2018InterspeechQuality-Net: An End-to-End Non-intrusive Speech Quality Assessment Model Based on BLSTM.Szu-Wei Fu, Yu Tsao, Hsin-Te Hwang, Hsin-Min Wang
2018InterspeechExemplar-Based Spectral Detail Compensation for Voice Conversion.Yu-Huai Peng, Hsin-Te Hwang, Yi-Chiao Wu, Yu Tsao, Hsin-Min Wang
2017ASRUNeural relevance-aware query modeling for spoken document retrieval.Tien-Hong Lo, Ying-Wen Chen, Kuan-Yu Chen, Hsin-Min Wang, Berlin Chen
2017ICASSPA locality-preserving essence vector modeling framework for spoken document retrieval.Kuan-Yu Chen, Shih-Hung Liu, Berlin Chen, Hsin-Min Wang
2017ICASSPDiscriminative autoencoders for speaker verification.Hung-Shin Lee, Yu-Ding Lu, Chin-Cheng Hsu, Yu Tsao, Hsin-Min Wang, Shyh-Kang Jeng
2017ICASSPLeveraging manifold learning for extractive broadcast news summarization.Shih-Hung Liu, Kuan-Yu Chen, Berlin Chen, Hsin-Min Wang, Wen-Lian Hsu
2017ICASSPSpeech emotion recognition with skew-robust neural networks.Po-Yuan Shih, Chia-Ping Chen, Hsin-Min Wang
2017ICASSPDeep-net fusion to classify shots in concert videos.Wen-Li Wei, Jen-Chun Lin, Tyng-Luh Liu, Yi-Hsuan Yang, Hsin-Min Wang, Hsiao-Rong Tyan, Hong-Yuan Mark Liao
2017ICASSPA locally linear embbeding based postfiltering approach for speech enhancement.Yi-Chiao Wu, Hsin-Te Hwang, Syu-Siang Wang, Chin-Cheng Hsu, Ying-Hui Lai, Yu Tsao, Hsin-Min Wang
2017InterspeechExploring the Use of Significant Words Language Modeling for Spoken Document Retrieval.Ying-Wen Chen, Kuan-Yu Chen, Hsin-Min Wang, Berlin Chen
2017InterspeechVoice Conversion from Unaligned Corpora Using Variational Autoencoding Wasserstein Generative Adversarial Networks.Chin-Cheng Hsu, Hsin-Te Hwang, Yi-Chiao Wu, Yu Tsao, Hsin-Min Wang
2017InterspeechWavelet Speech Enhancement Based on Robust Principal Component Analysis.Chia-Lung Wu, Hsiang-Ping Hsu, Syu-Siang Wang, Jeih-Weih Hung, Ying-Hui Lai, Hsin-Min Wang, Yu Tsao
2017InterspeechA Post-Filtering Approach Based on Locally Linear Embedding Difference Compensation for Speech Enhancement.Yi-Chiao Wu, Hsin-Te Hwang, Syu-Siang Wang, Chin-Cheng Hsu, Yu Tsao, Hsin-Min Wang
2017InterspeechDiscriminative Autoencoders for Acoustic Modeling.Ming-Han Yang, Hung-Shin Lee, Yu-Ding Lu, Kuan-Yu Chen, Yu Tsao, Berlin Chen, Hsin-Min Wang
2016COLINGLearning to Distill: The Essence Vector Modeling Framework.Kuan-Yu Chen, Shih-Hung Liu, Berlin Chen, Hsin-Min Wang
2016ICASSPImproved spoken document summarization with coverage modeling techniques.Kuan-Yu Chen, Shih-Hung Liu, Berlin Chen, Hsin-Min Wang
2016ICASSPDEMV-matchmaker: Emotional temporal course representation and deep similarity matching for automatic music video generation.Jen-Chun Lin, Wen-Li Wei, Hsin-Min Wang
2016InterspeechMinimization of Regression and Ranking Losses with Shallow Neural Networks on Automatic Sincerity Evaluation.Hung-Shin Lee, Yu Tsao, Chi-Chun Lee, Hsin-Min Wang, Wei-Cheng Lin, Wei-Chen Chen, Shan-Wen Hsiao, Shyh-Kang Jeng
2016InterspeechExploring Word Mover's Distance and Semantic-Aware Embedding Techniques for Extractive Broadcast News Summarization.Shih-Hung Liu, Kuan-Yu Chen, Yu-Lun Hsieh, Berlin Chen, Hsin-Min Wang, Hsu-Chun Yen, Wen-Lian Hsu
2016InterspeechLocally Linear Embedding for Exemplar-Based Spectral Conversion.Yi-Chiao Wu, Hsin-Te Hwang, Chin-Cheng Hsu, Yu Tsao, Hsin-Min Wang
2015ASRUIncorporating paragraph embeddings and density peaks clustering for spoken document summarization.Kuan-Yu Chen, Kai-Wun Shih, Shih-Hung Liu, Berlin Chen, Hsin-Min Wang
2015ICASSPI-vector based language modeling for query representation.Kuan-Yu Chen, Hsin-Min Wang, Berlin Chen, Hsin-Hsi Chen
2015ICASSPA histogram density modeling approach to music emotion recognition.Ju-Chiang Wang, Hsin-Min Wang, Gert R. G. Lanckriet
2015InterspeechLeveraging word embeddings for spoken document summarization.Kuan-Yu Chen, Shih-Hung Liu, Hsin-Min Wang, Berlin Chen, Hsin-Hsi Chen
2015InterspeechPositional language modeling for extractive broadcast news speech summarization.Shih-Hung Liu, Kuan-Yu Chen, Berlin Chen, Hsin-Min Wang, Hsu-Chun Yen, Wen-Lian Hsu
2014EMNLPLeveraging Effective Query Modeling Techniques for Speech Recognition and Summarization.Kuan-Yu Chen, Shih-Hung Liu, Berlin Chen, Ea-Ee Jan, Hsin-Min Wang, Wen-Lian Hsu, Hsin-Hsi Chen
2014ICASSPI-vector based language modeling for spoken document retrieval.Kuan-Yu Chen, Hung-Shin Lee, Hsin-Min Wang, Berlin Chen, Hsin-Hsi Chen
2014ICASSPSpeaker verification using kernel-based binary classifiers with binary operation derived features.Hung-Shin Lee, Yu Tso, Yun-Fan Chang, Hsin-Min Wang, Shyh-Kang Jeng
2014ICASSPEffective pseudo-relevance feedback for language modeling in extractive speech summarization.Shih-Hung Liu, Kuan-Yu Chen, Yu-Lun Hsieh, Berlin Chen, Hsin-Min Wang, Hsu-Chun Yen, Wen-Lian Hsu
2014ICASSPImproving music auto-tagging by intra-song instance bagging.Chin-Chia Michael Yeh, Ju-Chiang Wang, Yi-Hsuan Yang, Hsin-Min Wang
2014InterspeechEnsemble of machine learning algorithms for cognitive and physical speaker load detection.How Jing, Ting-Yao Hu, Hung-Shin Lee, Wei-Chen Chen, Chi-Chun Lee, Yu Tsao, Hsin-Min Wang
2014InterspeechClustering-based i-vector formulation for speaker recognition.Hung-Shin Lee, Yu Tsao, Hsin-Min Wang, Shyh-Kang Jeng
2014InterspeechEnhanced language modeling for extractive speech summarization with sentence relatedness information.Shih-Hung Liu, Kuan-Yu Chen, Yu-Lun Hsieh, Berlin Chen, Hsin-Min Wang, Hsu-Chun Yen, Wen-Lian Hsu
2013ICASSPEffective pseudo-relevance feedback for spoken document retrieval.Yi-Wen Chen, Kuan-Yu Chen, Hsin-Min Wang, Berlin Chen
2013ICASSPWeighted matrix factorization for spoken document retrieval.Kuan-Yu Chen, Hsin-Min Wang, Berlin Chen, Hsin-Hsi Chen
2013ICASSPSubspace-based phonotactic language recognition using multivariate dynamic linear models.Hung-Shin Lee, Yu-Chin Shih, Hsin-Min Wang, Shyh-Kang Jeng
2013IJCNLPSemantic Nave Bayes Classifier for Document Classification.How Jing, Yu Tsao, Kuan-Yu Chen, Hsin-Min Wang
2013InterspeechAlleviating the over-smoothing problem in GMM-based voice conversion with discriminative training.Hsin-Te Hwang, Yu Tsao, Hsin-Min Wang, Yih-Ru Wang, Sin-Horng Chen
2013PAKDDQuery-Document Relevance Topic Models.Meng-Sung Wu, Chia-Ping Chen, Hsin-Min Wang
2012ICASSPGeneralized k-labelset ensemble for multi-label classification.Hung-Yi Lo, Shou-De Lin, Hsin-Min Wang
2012ICASSPPlaying with tagging: A real-time tagging music player.Ju-Chiang Wang, Hsin-Min Wang, Shyh-Kang Jeng
2012ICPRTerm relevance dependency model for text classification.Meng-Sung Wu, Hsin-Min Wang
2012InterspeechWord Relevance Modeling for Speech Recognition.Kuan-Yu Chen, Hao-Chin Chang, Berlin Chen, Hsin-Min Wang
2012InterspeechA Study of Mutual Information for GMM-Based Spectral Conversion.Hsin-Te Hwang, Yu Tsao, Hsin-Min Wang, Yih-Ru Wang, Sin-Horng Chen
2012InterspeechSubspace-Based Feature Representation and Learning for Language Recognition.Yu-Chin Shih, Hung-Shin Lee, Hsin-Min Wang, Shyh-Kang Jeng
2012PAKDDA Term Association Translation Model for Naive Bayes Text Classification.Meng-Sung Wu, Hsin-Min Wang
2011ICASSPCost-sensitive stacking for audio tag annotation and retrieval.Hung-Yi Lo, Ju-Chiang Wang, Hsin-Min Wang, Shou-De Lin
2011MMMAudio Tag Annotation and Retrieval Using Tag Count Information.Hung-Yi Lo, Shou-De Lin, Hsin-Min Wang
2010ICASSPBackground music identification through content filtering and min-hash matching.Chih-Yi Chiu, Dimitrios Bountouridis, Ju-Chiang Wang, Hsin-Min Wang
2010ICIPDetecting pitching frames in baseball game video using Markov random walk.Chih-Yi Chiu, Po-Chih Lin, Wei-Ming Chang, Hsin-Min Wang, Shi-Nine Yang
2010ICPRA Discriminative and Heteroscedastic Linear Feature Transformation for Multiclass Classification.Hung-Shin Lee, Hsin-Min Wang, Berlin Chen
2010InterspeechPhonetic subspace mixture model for speaker diarization.I-Fan Chen, Shih-Sian Cheng, Hsin-Min Wang
2010InterspeechBayesian speaker recognition using Gaussian mixture model and laplace approximation.Shih-Sian Cheng, I-Fan Chen, Hsin-Min Wang
2009CIKMLearning to rank from Bayesian decision inference.Jen-Wei Kuo, Pu-Jen Cheng, Hsin-Min Wang
2009InterspeechSpeaker diarization using divide-and-conquer.Shih-Sian Cheng, Chun-Han Tseng, Chia-Ping Chen, Hsin-Min Wang
2009InterspeechArticulatory feature asynchrony analysis and compensation in detection-based ASR.I-Fan Chen, Hsin-Min Wang
2008ICASSPBIC-based audio segmentation by divide-and-conquer.Shih-Sian Cheng, Hsin-Min Wang, Hsin-Chia Fu
2008ICASSPA comparative study of probabilistic ranking models for spoken document summarization.Shih-Hsiang Lin, Yi-Ting Chen, Hsin-Min Wang, Bin Chen
2007ASRUSpoken document summarization using relevant information.Yi-Ting Chen, Shih-Hsiang Lin, Hsin-Min Wang, Berlin Chen
2007ICASSPImproved Methods for Characterizing the Alternative Hypothesis using Minimum Verification Error Training for LLR-Based Speaker Verification.Yi-Hsiang Chao, Wei-Ho Tsai, Hsin-Min Wang, Ruei-Chuan Chang
2007ICASSPPhonetic Boundary Refinement using Support Vector Machine.Hung-Yi Lo, Hsin-Min Wang
2007ICASSPSpeaker Clustering Based on Minimum Rand Index.Wei-Ho Tsai, Hsin-Min Wang
2007InterspeechEvolutionary minimum verification error learning of the alternative hypothesis model for LLR-based speaker verification.Yi-Hsiang Chao, Wei-Ho Tsai, Shih-Sian Cheng, Hsin-Min Wang, Ruei-Chuan Chang
2007InterspeechA unified probabilistic generative framework for extractive spoken document summarization.Yi-Ting Chen, Hsuan-Sheng Chiu, Hsin-Min Wang, Berlin Chen
2007InterspeechImproved HMM/SVM methods for automatic phoneme segmentation.Jen-Wei Kuo, Hung-Yi Lo, Hsin-Min Wang
2006ICASSPOn Maximizing the Within-Cluster Homogeneity of Speaker Voice Characteristics For Speech Utterance Clustering.Wei-Ho Tsai, Hsin-Min Wang
2006ICPRA Kernel-based Discrimination Framework for Solving Hypothesis Testing Problems with Application to Speaker Verification.Yi-Hsiang Chao, Wei-Ho Tsai, Hsin-Min Wang, Ruei-Chuan Chang
2006ICPRA Prototypes-Embedded Genetic K-means Algorithm.Shih-Sian Cheng, Yi-Hsiang Chao, Hsin-Min Wang, Hsin-Chia Fu
2006InterspeechImproving the characterization of the alternative hypothesis via kernel discriminant analysis for likelihood ratio-based speaker verification.Yi-Hsiang Chao, Wei-Ho Tsai, Hsin-Min Wang, Ruei-Chuan Chang
2006InterspeechMinimum boundary error training for automatic phonetic segmentation.Jen-Wei Kuo, Hsin-Min Wang
2005ICASSPGmm-Based Bhattacharyya Kernel Fisher Discriminant Analysis For Speaker Recognition.Yi-Hsiang Chao, Hsin-Min Wang, Ruei-Chuan Chang
2005ICASSPClustering Speech Utterances by Speaker Using Eigenvoice-Motivated Vector Space Models.Wei-Ho Tsai, Shih-Sian Cheng, Yi-Hsiang Chao, Hsin-Min Wang
2005InterspeechSpeaker clustering of unknown utterances based on maximum purity estimation.Wei-Ho Tsai, Hsin-Min Wang
2004ICASSPAutomatic detection and tracking of target singer in multi-singer music recordings.Wei-Ho Tsai, Hsin-Min Wang
2004InterspeechStatistical Chinese spoken document retrieval using latent topical information.Jen-Wei Kuo, Yao-Min Huang, Berlin Chen, Hsin-Min Wang
2004InterspeechSpeaker clustering of speech utterances using a voice characteristic reference space.Wei-Ho Tsai, Shih-Sian Cheng, Hsin-Min Wang
2004InterspeechMETRIC-SEQDAC: a hybrid approach for audio segmentation.Hsin-Min Wang, Shih-Sian Cheng
2003InterspeechA sequential metric-based audio segmentation method via the Bayesian information criterion.Shih-Sian Cheng, Hsin-Min Wang
2003InterspeechMulti-scale document expansion in English-Mandarin cross-language spoken document retrieval.Wai Kit Lo, Yuk-Chi Li, Gina-Anne Levow, Hsin-Min Wang, Helen M. Meng
2003InterspeechAutomatic singer identification of popular music recordings via estimation and modeling of solo vocal signal.Wei-Ho Tsai, Hsin-Min Wang, Dwight Rodgers
2001ICASSPEigenspace-based maximum a posteriori linear regression for rapid speaker adaptation.Kuan-Ting Chen, Hsin-Min Wang
2001ICASSPMulti-scale-audio indexing for translingual spoken document retrieval.Hsin-Min Wang, Helen M. Meng, Patrick Schone, Berlin Chen, Wai-Kit Lo
2001InterspeechImproved spoken document retrieval by exploring extra acoustic and linguistic cues.Berlin Chen, Hsin-Min Wang, Lin-Shan Lee
2001InterspeechAn HMM/n-gram-based linguistic processing approach for Mandarin spoken document retrieval.Berlin Chen, Hsin-Min Wang, Lin-Shan Lee
2001InterspeechComparative analysis for data-driven temporal filters obtained via principal component analysis (PCA) and linear discriminant analysis (LDA) in speech recognition.Jeih-Weih Hung, Hsin-Min Wang, Lin-Shan Lee
2001NAACLMandarin-English Information: Investigating Translingual Speech Retrieval.Helen M. Meng, Berlin Chen, Sanjeev Khudanpur, Gina-Anne Levow, Wai-Kit Lo, Douglas W. Oard, Patrick Schone, Karen Tang, Hsin-Min Wang, Jianqiang Wang
2000ICASSPRetrieval of broadcast news speech in Mandarin Chinese collected in Taiwan using syllable-level statistical characteristics.Berlin Chen, Hsin-Min Wang, Lin-Shan Lee
2000InterspeechFast speaker adaptation using eigenspace-based maximum likelihood linear regression.Kuan-Ting Chen, Wen-Wei Liau, Hsin-Min Wang, Lin-Shan Lee
2000InterspeechRetrieval of mandarin broadcast news using spoken queries.Berlin Chen, Hsin-Min Wang, Lin-Shan Lee
2000InterspeechAutomatic metric-based speech segmentation for broadcast news via principal component analysis.Jeih-Weih Hung, Hsin-Min Wang, Lin-Shan Lee
1999InterspeechConsistent dialogue across concurrent topics based on an expert system model.Bor-Shen Lin, Hsin-Min Wang, Lin-Shan Lee
1998InterspeechA*-admissible key-phrase spotting with sub-syllable level utterance verification.Berlin Chen, Hsin-Min Wang, Lee-Feng Chien, Lin-Shan Lee
1998InterspeechHierarchical tag-graph search for spontaneous speech understanding in spoken dialog systems.Bor-Shen Lin, Berlin Chen, Hsin-Min Wang, Lin-Shan Lee
1998InterspeechTowards a Mandarin voice memo system.Hsin-Min Wang, Bor-Shen Lin, Berlin Chen, Bo-Ren Bai
1997ICASSPInternet Chinese information retrieval using unconstrained Mandarin speech queries based on a client-server architecture and a PAT-tree-based language model.Lee-Feng Chien, Sung-Chien Lin, Jenn-Chau Hong, Ming-Chiuan Chen, Hsin-Min Wang, Jia-Lin Shen, Keh-Jiann Chen, Lin-Shan Lee
1995ICASSPComplete recognition of continuous Mandarin speech for Chinese language with very large vocabulary but limited training data.Hsin-Min Wang, Jia-Lin Shen, Yen-Ju Yang, Chiu-yu Tseng, Lin-Shan Lee
1995InterspeechFast and accurate continuous speech recognition for Chinese language with very large vocabulary.Tai-Hsuan Ho, Hsin-Min Wang, Lee-Feng Chien, Keh-Jiann Chen, Lin-Shan Lee
1994ICASSPAn initial study on a segmental probability model approach to large-vocabulary continuous Mandarin speech recognition.Jia-Lin Shen, Hsin-Min Wang, Bo-Ren Bai, Lin-Shan Lee
1994InterspeechIncremental speaker adaptation using phonetically balanced training sentences for Mandarin syllable recognition based on segmental probability models.Jia-Lin Shen, Hsin-Min Wang, Ren-Yuan Lyu, Lin-Shan Lee
1993ICASSPGolden Mandarin (II)-an improved single-chip real-time Mandarin dictation machine for Chinese language with very large vocabulary.Lin-Shan Lee, Chiu-yu Tseng, Keh-Jiann Chen, I-Jung Hung, Ming-Yu Lee, Lee-Feng Chien, Yumin Lee, Ren-Yuan Lyu, Hsin-Min Wang, Yung-Chuan Wu, Tung-Sheng Lin, Hung-Yan Gu, Chi-ping Nee, Chun-Yi Liao, Yeng-Ju Yang, Yuan-Cheng Chang, Rung-Chiung Yang