| 2026 | LREC | Efficient Dialect-Aware Modeling and Conditioning for Low-Resource Taiwanese Hakka Speech Processing. | An-Ci Peng, Kuan-Tang Huang, Tien-Hong Lo, Hung-Shin Lee, Hsin-Min Wang, Berlin Chen |
| 2026 | LREC | MASA: A Novel Multimodal Foundation Model for L2 Speaking Assessment in Picture-description Scenarios. | Bi-Cheng Yan, Fu-An Chao, Hong-Yun Lin, Berlin Chen |
| 2026 | LREC | TG-ASR: Translation-Guided Learning with Parallel Gated Cross Attention for Low-Resource Automatic Speech Recognition. | Cheng-Yeh Yang, Chien-Chun Wang, Li-Wei Chen, Hung-Shin Lee, Hsin-Min Wang, Berlin Chen |
| 2025 | ASRU | Beyond Modality Limitations: A Unified MLLM Approach to Automated Speaking Assessment with Effective Curriculum Learning. | Yu-Hsuan Fang, Tien-Hong Lo, Yao-Ting Sung, Berlin Chen |
| 2025 | ASRU | Revealing the Role of Audio Channels in ASR Performance Degradation. | Kuan-Tang Huang, Li-Wei Chen, Hung-Shin Lee, Berlin Chen, Hsin-Min Wang |
| 2025 | ASRU | PRIME: Novel Prompting Strategies for Effective Biasing Word Recognition in Contextualized ASR. | Yu-Chun Liu, Li-Ting Pai, Yi-Cheng Wang, Bi-Cheng Yan, Hsin-Wei Wang, Chi-Han Lin, Juan-Wei Xu, Berlin Chen |
| 2025 | ASRU | An Effective Strategy for Modeling Score Ordinality and Non-uniform Intervals in Automated Speaking Assessment. | Tien-Hong Lo, Szu-Yu Chen, Yao-Ting Sung, Berlin Chen |
| 2025 | ASRU | QAMRO: Quality-aware Adaptive Margin Ranking Optimization for Human-aligned Assessment of Audio Generation Systems. | Chien-Chun Wang, Kuan-Tang Huang, Cheng-Yeh Yang, Hung-Shin Lee, Hsin-Min Wang, Berlin Chen |
| 2025 | ASRU | SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization. | Chien-Chun Wang, En-Lun Yu, Jeih-Weih Hung, Shih-Chieh Huang, Berlin Chen |
| 2025 | ICASSP | Channel-Aware Domain-Adaptive Generative Adversarial Network for Robust Speech Recognition. | Chien-Chun Wang, Li-Wei Chen, Cheng-Kang Chou, Hung-Shin Lee, Berlin Chen, Hsin-Min Wang |
| 2025 | ICASSP | ConPCO: Preserving Phoneme Characteristics For Automatic Pronunciation Assessment Leveraging Contrastive Ordinal Regularization. | Bi-Cheng Yan, Yi-Cheng Wang, Jiun-Ting Li, Meng-Shin Lin, Hsin-Wei Wang, Wei-Cheng Chao, Berlin Chen |
| 2025 | ICCV | Long-Context State-Space Video World Models. | Ryan Po, Yotam Nitzan, Richard Zhang, Berlin Chen, Tri Dao, Eli Shechtman, Gordon Wetzstein, Xun Huang |
| 2025 | IJCNLP | HiPPO: Exploring A Novel Hierarchical Pronunciation Assessment Approach for Spoken Languages. | Bi-Cheng Yan, Hsin Wei Wang, Fu-An Chao, Tien-Hong Lo, Yung-Chang Hsu, Berlin Chen |
| 2025 | Interspeech | Flexible VAD-PVAD Transition: A Detachable PVAD Module for Dynamic Encoder RNN VAD. | En-Lun Yu, Chien-Chun Wang, Jeih-Weih Hung, Shih-Chieh Huang, Berlin Chen |
| 2025 | NAACL | Towards Efficient and Multifaceted Computer-assisted Pronunciation Training Leveraging Hierarchical Selective State Space Model and Decoupled Cross-entropy Loss. | Fu-An Chao, Berlin Chen |
| 2024 | ACL | An Effective Pronunciation Assessment Approach Leveraging Hierarchical Transformers and Pre-training Strategies. | Bi-Cheng Yan, Jiun-Ting Li, Yi-Cheng Wang, Hsin-Wei Wang, Tien-Hong Lo, Yung-Chang Hsu, Wei-Cheng Chao, Berlin Chen |
| 2024 | COLING | DANCER: Entity Description Augmented Named Entity Corrector for Automatic Speech Recognition. | Yi-Cheng Wang, Hsin-Wei Wang, Bi-Cheng Yan, Chi-Han Lin, Berlin Chen |
| 2024 | ICASSP | What Do Neural Networks Listen to? Exploring the Crucial Bands in Speech Enhancement Using SINC-Convolution. | Kuan-Hsun Ho, Jeih-weih Hung, Berlin Chen |
| 2024 | ICASSP | An Effective Mixture-Of-Experts Approach For Code-Switching Speech Recognition Leveraging Encoder Disentanglement. | Tzu-Ting Yang, Hsin-Wei Wang, Yi-Cheng Wang, Chi-Han Lin, Berlin Chen |
| 2024 | Interspeech | TEEMI: a speaking practice tool for L2 English learners. | Szu-Yu Chen, Tien-Hong Lo, Yao-Ting Sung, Ching-Yu Tseng, Berlin Chen |
| 2024 | Interspeech | EZTalking: English assessment platform for teachers and students. | Yu-Sheng Tsao, Yung-Chang Hsu, Jiun-Ting Li, Siang-Hong Weng, Tien-Hong Lo, Berlin Chen |
| 2024 | Interspeech | Optimizing Automatic Speech Assessment: W-RankSim Regularization and Hybrid Feature Fusion Strategies. | Chung-Wen Wu, Berlin Chen |
| 2024 | Interspeech | Speaker Conditional Sinc-Extractor for Personal VAD. | En-Lun Yu, Kuan-Hsun Ho, Jeih-weih Hung, Shih-Chieh Huang, Berlin Chen |
| 2024 | NAACL | An Effective Automated Speaking Assessment Approach to Mitigating Data Scarcity and Imbalanced Distribution. | Tien-Hong Lo, Fu-An Chao, Tzu-I Wu, Yao-Ting Sung, Berlin Chen |
| 2023 | ASRU | Preserving Phonemic Distinctions For Ordinal Regression: A Novel Loss Function For Automatic Pronunciation Assessment. | Bi-Cheng Yan, Hsin-Wei Wang, Yi-Cheng Wang, Jiun-Ting Li, Chi-Han Lin, Berlin Chen |
| 2023 | ICASSP | Effective Graph-Based Modeling of Articulation Traits for Mispronunciation Detection and Diagnosis. | Bi-Cheng Yan, Hsin-Wei Wang, Yi-Cheng Wang, Berlin Chen |
| 2023 | Interspeech | A Hierarchical Context-aware Modeling Approach for Multi-aspect and Multi-granular Pronunciation Assessment. | Fu-An Chao, Tien-Hong Lo, Tzu-I Wu, Yao-Ting Sung, Berlin Chen |
| 2022 | ICASSP | Exploring Non-Autoregressive End-to-End Neural Modeling for English Mispronunciation Detection and Diagnosis. | Hsin-Wei Wang, Bi-Cheng Yan, Hsuan-Sheng Chiu, Yung-Chang Hsu, Berlin Chen |
| 2022 | IJCNN | Effective Cross-Utterance Language Modeling for Conversational Speech Recognition. | Bi-Cheng Yan, Hsin-Wei Wang, Shih-Hsuan Chiu, Hsuan-Sheng Chiu, Berlin Chen |
| 2021 | ASRU | TENET: A Time-Reversal Enhancement Network for Noise-Robust ASR. | Fu-An Chao, Shao-Wei Fan-Jiang, Bi-Cheng Yan, Jeih-weih Hung, Berlin Chen |
| 2021 | ASRU | Towards Robust Mispronunciation Detection and Diagnosis for L2 English Learners with Accent-Modulating Methods. | Shao-Wei Fan-Jiang, Bi-Cheng Yan, Tien-Hong Lo, Fu-An Chao, Berlin Chen |
| 2021 | IJCNN | Cross-sentence Neural Language Models for Conversational Speech Recognition. | Shih-Hsuan Chiu, Tien-Hong Lo, Berlin Chen |
| 2020 | ICASSP | Spoken Document Retrieval Leveraging Bert-Based Modeling and Query Reformulation. | Shao-Wei Fan-Jiang, Tien-Hong Lo, Berlin Chen |
| 2020 | Interspeech | The NTNU System at the Interspeech 2020 Non-Native Children's Speech ASR Challenge. | Tien-Hong Lo, Fu-An Chao, Shi-Yan Weng, Berlin Chen |
| 2020 | Interspeech | An Effective End-to-End Modeling Approach for Mispronunciation Detection. | Tien-Hong Lo, Shi-Yan Weng, Hsiu-Jui Chang, Berlin Chen |
| 2020 | Interspeech | An End-to-End Mispronunciation Detection System for L2 English Speech Leveraging Novel Anti-Phone Modeling. | Bi-Cheng Yan, Meng-Che Wu, Hsiao-Tsung Hung, Berlin Chen |
| 2019 | ACL | Can You Tell Me How to Get Past Sesame Street? Sentence-Level Pretraining Beyond Language Modeling. | Alex Wang, Jan Hula, Patrick Xia, Raghavendra Pappagari, R. Thomas McCoy, Roma Patel, Najoung Kim, Ian Tenney, Yinghui Huang, Katherin Yu, Shuning Jin, Berlin Chen, Benjamin Van Durme, Edouard Grave, Ellie Pavlick, Samuel R. Bowman |
| 2019 | ASRU | Enhanced Bert-Based Ranking Models for Spoken Document Retrieval. | Hsiao-Yun Lin, Tien-Hong Lo, Berlin Chen |
| 2019 | ICASSP | A Hierarchical Neural Summarization Framework for Spoken Documents. | Tzu-En Liu, Shih-Hung Liu, Berlin Chen |
| 2019 | ICASSP | Polyphonic Music Transcription with Semantic Segmentation. | Yu-Te Wu, Berlin Chen, Li Su |
| 2019 | ICLR | What do you learn from context? Probing for sentence structure in contextualized word representations. | Ian Tenney, Patrick Xia, Berlin Chen, Alex Wang, Adam Poliak, R. Thomas McCoy, Najoung Kim, Benjamin Van Durme, Samuel R. Bowman, Dipanjan Das, Ellie Pavlick |
| 2018 | ICASSP | Essence Vector-Based Query Modeling for Spoken Document Retrieval. | Kuan-Yu Chen, Shih-Hung Liu, Berlin Chen, Hsin-Min Wang |
| 2018 | ICASSP | Automatic Music Transcription Leveraging Generalized Cepstral Features and Deep Learning. | Yu-Te Wu, Berlin Chen, Li Su |
| 2017 | ASRU | Neural relevance-aware query modeling for spoken document retrieval. | Tien-Hong Lo, Ying-Wen Chen, Kuan-Yu Chen, Hsin-Min Wang, Berlin Chen |
| 2017 | ICASSP | A locality-preserving essence vector modeling framework for spoken document retrieval. | Kuan-Yu Chen, Shih-Hung Liu, Berlin Chen, Hsin-Min Wang |
| 2017 | ICASSP | Leveraging manifold learning for extractive broadcast news summarization. | Shih-Hung Liu, Kuan-Yu Chen, Berlin Chen, Hsin-Min Wang, Wen-Lian Hsu |
| 2017 | Interspeech | Exploring the Use of Significant Words Language Modeling for Spoken Document Retrieval. | Ying-Wen Chen, Kuan-Yu Chen, Hsin-Min Wang, Berlin Chen |
| 2017 | Interspeech | Discriminative Autoencoders for Acoustic Modeling. | Ming-Han Yang, Hung-Shin Lee, Yu-Ding Lu, Kuan-Yu Chen, Yu Tsao, Berlin Chen, Hsin-Min Wang |
| 2017 | Interspeech | Exploring Low-Dimensional Structures of Modulation Spectra for Robust Speech Recognition. | Bi-Cheng Yan, Chin-Hong Shih, Shih-Hung Liu, Berlin Chen |
| 2016 | COLING | Learning to Distill: The Essence Vector Modeling Framework. | Kuan-Yu Chen, Shih-Hung Liu, Berlin Chen, Hsin-Min Wang |
| 2016 | ICASSP | Improved spoken document summarization with coverage modeling techniques. | Kuan-Yu Chen, Shih-Hung Liu, Berlin Chen, Hsin-Min Wang |
| 2016 | Interspeech | Mispronunciation Detection Leveraging Maximum Performance Criterion Training of Acoustic Models and Decision Functions. | Yao-Chi Hsu, Ming-Han Yang, Hsiao-Tsung Hung, Berlin Chen |
| 2016 | Interspeech | Exploring Word Mover's Distance and Semantic-Aware Embedding Techniques for Extractive Broadcast News Summarization. | Shih-Hung Liu, Kuan-Yu Chen, Yu-Lun Hsieh, Berlin Chen, Hsin-Min Wang, Hsu-Chun Yen, Wen-Lian Hsu |
| 2015 | ASRU | Incorporating paragraph embeddings and density peaks clustering for spoken document summarization. | Kuan-Yu Chen, Kai-Wun Shih, Shih-Hung Liu, Berlin Chen, Hsin-Min Wang |
| 2015 | ICASSP | I-vector based language modeling for query representation. | Kuan-Yu Chen, Hsin-Min Wang, Berlin Chen, Hsin-Hsi Chen |
| 2015 | Interspeech | Leveraging word embeddings for spoken document summarization. | Kuan-Yu Chen, Shih-Hung Liu, Hsin-Min Wang, Berlin Chen, Hsin-Hsi Chen |
| 2015 | Interspeech | Positional language modeling for extractive broadcast news speech summarization. | Shih-Hung Liu, Kuan-Yu Chen, Berlin Chen, Hsin-Min Wang, Hsu-Chun Yen, Wen-Lian Hsu |
| 2014 | EMNLP | Leveraging Effective Query Modeling Techniques for Speech Recognition and Summarization. | Kuan-Yu Chen, Shih-Hung Liu, Berlin Chen, Ea-Ee Jan, Hsin-Min Wang, Wen-Lian Hsu, Hsin-Hsi Chen |
| 2014 | ICASSP | I-vector based language modeling for spoken document retrieval. | Kuan-Yu Chen, Hung-Shin Lee, Hsin-Min Wang, Berlin Chen, Hsin-Hsi Chen |
| 2014 | ICASSP | Effective pseudo-relevance feedback for language modeling in extractive speech summarization. | Shih-Hung Liu, Kuan-Yu Chen, Yu-Lun Hsieh, Berlin Chen, Hsin-Min Wang, Hsu-Chun Yen, Wen-Lian Hsu |
| 2014 | Interspeech | Effective modulation spectrum factorization for robust speech recognition. | Yu-Chen Kao, Yi-Ting Wang, Berlin Chen |
| 2014 | Interspeech | Enhanced language modeling for extractive speech summarization with sentence relatedness information. | Shih-Hung Liu, Kuan-Yu Chen, Yu-Lun Hsieh, Berlin Chen, Hsin-Min Wang, Hsu-Chun Yen, Wen-Lian Hsu |
| 2013 | ASRU | Effective pseudo-relevance feedback for language modeling in speech recognition. | Berlin Chen, Yi-Wen Chen, Kuan-Yu Chen, Ea-Ee Jan |
| 2013 | HCI | The Influence of Guanxi Gradient on Crew Resource Management and Values in the Cockpit. | Hung-Sying Jing, Berlin Chen |
| 2013 | ICASSP | Effective pseudo-relevance feedback for spoken document retrieval. | Yi-Wen Chen, Kuan-Yu Chen, Hsin-Min Wang, Berlin Chen |
| 2013 | ICASSP | Weighted matrix factorization for spoken document retrieval. | Kuan-Yu Chen, Hsin-Min Wang, Berlin Chen, Hsin-Hsi Chen |
| 2013 | Interspeech | Incorporating proximity information for relevance language modeling in speech recognition. | Yi-Wen Chen, Bo-Han Hao, Kuan-Yu Chen, Berlin Chen |
| 2013 | Interspeech | Histogram equalization of real and imaginary modulation spectra for noise-robust speech recognition. | Hsin-Ju Hsieh, Berlin Chen, Jeih-weih Hung |
| 2013 | Interspeech | Distribution-based feature normalization for robust speech recognition leveraging context and dynamics cues. | Yu-Chen Kao, Berlin Chen |
| 2012 | ICASSP | Constructing effective ranking models for speech summarization. | Yueng-Tien Lo, Shih-Hsiang Lin, Berlin Chen |
| 2012 | Interspeech | Word Relevance Modeling for Speech Recognition. | Kuan-Yu Chen, Hao-Chin Chang, Berlin Chen, Hsin-Min Wang |
| 2012 | Interspeech | Exploring Joint Equalization of Spatial-Temporal Contextual Statistics of Speech Features for Robust Speech Recognition. | Hsin-Ju Hsieh, Jeih-Weih Hung, Berlin Chen |
| 2011 | ASRU | Query modeling for spoken document retrieval. | Berlin Chen, Pei-Ning Chen, Kuan-Yu Chen |
| 2011 | ICASSP | Relevance language modeling for speech recognition. | Kuan-Yu Chen, Berlin Chen |
| 2011 | ICASSP | Handling verbose queries for spoken document retrieval. | Shih-Hsiang Lin, Ea-Ee Jan, Berlin Chen |
| 2011 | IJCNLP | An Effective and Robust Framework for Transliteration Exploration. | Ea-Ee Jan, Niyu Ge, Shih-Hsiang Lin, Berlin Chen |
| 2011 | Interspeech | Leveraging Relevance Cues for Improved Spoken Document Retrieval. | Pei-Ning Chen, Kuan-Yu Chen, Berlin Chen |
| 2010 | ACL | A Risk Minimization Framework for Extractive Speech Summarization. | Shih-Hsiang Lin, Berlin Chen |
| 2010 | ICASSP | Latent topic modeling of word vicinity information for speech recognition. | Kuan-Yu Chen, Hsuan-Sheng Chiu, Berlin Chen |
| 2010 | ICASSP | Leveraging evaluation metric-related training criteria for speech summarization. | Shih-Hsiang Lin, Yu-Mei Chang, Jia-Wen Liu, Berlin Chen |
| 2010 | ICPR | A Discriminative and Heteroscedastic Linear Feature Transformation for Multiclass Classification. | Hung-Shin Lee, Hsin-Min Wang, Berlin Chen |
| 2010 | Interspeech | Extractive speech summarization - from the view of decision theory. | Shih-Hsiang Lin, Yao-Ming Yeh, Berlin Chen |
| 2009 | ASRU | Generalized likelihood ratio discriminant analysis. | Hung-Shin Lee, Berlin Chen |
| 2009 | ICASSP | Latent topic modelling of word co-occurence information for spoken document retrieval. | Berlin Chen |
| 2009 | ICASSP | Empirical error rate minimization based linear discriminant analysis. | Hung-Shin Lee, Berlin Chen |
| 2009 | Interspeech | Improved speech summarization with multiple-hypothesis representations and kullback-leibler divergence measures. | Shih-Hsiang Lin, Berlin Chen |
| 2009 | Interspeech | Hybrids of supervised and unsupervised models for extractive speech summarization. | Shih-Hsiang Lin, Yueng-Tien Lo, Yao-Ming Yeh, Berlin Chen |
| 2008 | Interspeech | Exploiting spatial-temporal feature distribution characteristics for robust speech recognition. | Wei-Hau Chen, Shih-Hsiang Lin, Berlin Chen |
| 2008 | Interspeech | Linear discriminant feature extraction using weighted classification confusion information. | Hung-Shin Lee, Berlin Chen |
| 2007 | ASRU | Spoken document summarization using relevant information. | Yi-Ting Chen, Shih-Hsiang Lin, Hsin-Min Wang, Berlin Chen |
| 2007 | ASRU | Investigating the use of speech features and their corresponding distribution characteristics for robust speech recognition. | Shih-Hsiang Lin, Yao-Ming Yeh, Berlin Chen |
| 2007 | ASRU | Training data selection for improving discriminative training of acoustic models. | Shih-Hung Liu, Fang-Hui Chu, Shih-Hsiang Lin, Hung-Shin Lee, Berlin Chen |
| 2007 | ICASSP | Word Topical Mixture Models for Dynamic Language Model Adaptation. | Hsuan-Sheng Chin, Berlin Chen |
| 2007 | Interspeech | A unified probabilistic generative framework for extractive spoken document summarization. | Yi-Ting Chen, Hsuan-Sheng Chiu, Hsin-Min Wang, Berlin Chen |
| 2007 | Interspeech | Cluster-based polynomial-fit histogram equalization (CPHEQ) for robust speech recognition. | Shih-Hsiang Lin, Yao-Ming Yeh, Berlin Chen |
| 2007 | Interspeech | Subword-based position specific posterior lattices (s-PSPL) for indexing speech information. | Yi-Cheng Pan, Hung-lin Chang, Berlin Chen, Lin-Shan Lee |
| 2006 | ICASSP | Chinese Spoken Document Summarization Using Probabilistic Latent Topical Information. | Berlin Chen, Yao-Ming Yeh, Yao-Min Huang, Yi-Ting Chen |
| 2006 | Interspeech | Exploiting polynomial-fit histogram equalization and temporal average for robust speech recognition. | Shih-Hsiang Lin, Yao-Ming Yeh, Berlin Chen |
| 2005 | Interspeech | Speech retrieval of Mandarin broadcast news via mobile devices. | Berlin Chen, Yi-Ting Chen, Chih-Hao Chang, Hung-Bin Chen |
| 2005 | Interspeech | Minimum word error based discriminative training of language models. | Jen-Wei Kuo, Berlin Chen |
| 2005 | Interspeech | Hierarchical topic organization and visual presentation of spoken documents using probabilistic latent semantic analysis (PLSA) for efficient retrieval/browsing applications. | Te-Hsuan Li, Ming-Han Lee, Berlin Chen, Lin-Shan Lee |
| 2004 | ICASSP | Lightly supervised and data-driven approaches to Mandarin broadcast news transcription. | Berlin Chen, Jen-Wei Kuo, Wen-Hung Tsai |
| 2004 | Interspeech | Statistical Chinese spoken document retrieval using latent topical information. | Jen-Wei Kuo, Yao-Min Huang, Berlin Chen, Hsin-Min Wang |
| 2002 | Interspeech | Improved Chinese spoken document retrieval with hybrid modeling and data-driven indexing features. | Chun-Jen Wang, Berlin Chen, Lin-Shan Lee |
| 2001 | ICASSP | Multi-scale-audio indexing for translingual spoken document retrieval. | Hsin-Min Wang, Helen M. Meng, Patrick Schone, Berlin Chen, Wai-Kit Lo |
| 2001 | Interspeech | Improved spoken document retrieval by exploring extra acoustic and linguistic cues. | Berlin Chen, Hsin-Min Wang, Lin-Shan Lee |
| 2001 | Interspeech | An HMM/n-gram-based linguistic processing approach for Mandarin spoken document retrieval. | Berlin Chen, Hsin-Min Wang, Lin-Shan Lee |
| 2001 | NAACL | Mandarin-English Information: Investigating Translingual Speech Retrieval. | Helen M. Meng, Berlin Chen, Sanjeev Khudanpur, Gina-Anne Levow, Wai-Kit Lo, Douglas W. Oard, Patrick Schone, Karen Tang, Hsin-Min Wang, Jianqiang Wang |
| 2000 | ICASSP | Retrieval of broadcast news speech in Mandarin Chinese collected in Taiwan using syllable-level statistical characteristics. | Berlin Chen, Hsin-Min Wang, Lin-Shan Lee |
| 2000 | Interspeech | Retrieval of mandarin broadcast news using spoken queries. | Berlin Chen, Hsin-Min Wang, Lin-Shan Lee |
| 1998 | Interspeech | A*-admissible key-phrase spotting with sub-syllable level utterance verification. | Berlin Chen, Hsin-Min Wang, Lee-Feng Chien, Lin-Shan Lee |
| 1998 | Interspeech | Hierarchical tag-graph search for spontaneous speech understanding in spoken dialog systems. | Bor-Shen Lin, Berlin Chen, Hsin-Min Wang, Lin-Shan Lee |
| 1998 | Interspeech | Towards a Mandarin voice memo system. | Hsin-Min Wang, Bor-Shen Lin, Berlin Chen, Bo-Ren Bai |