Skip to content

Helen M. Meng

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

119

Venues

14

Active years

1990–2026

Best venue rank

A*

Where they publish

Papers

119 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLMasked Text-to-Audio Flow-Matching and Reward Feedback Optimization.Rongjie Huang, Dongchao Yang, Wenxiang Guo, Huadai Liu, Xize Cheng, Zehan Wang, Zhou Zhao, Xixin Wu, Helen M. Meng
2026ACLUniSRM: A Unified Speech Reward Model for Reasoning-Based Fine-grained Assessment.Yuanyuan Wang, Dongchao Yang, Yayue Deng, Zhiyong Wu, Steven Y. Guo, Helen M. Meng, Xixin Wu
2025ACLGenerate, Discriminate, Evolve: Enhancing Context Faithfulness via Fine-Grained Sentence-Level Self-Evolution.Kun Li, Tianhua Zhang, Yunxiang Li, Hongyin Luo, Abdalla Mohamed Salama Sayed Moustafa, Xixin Wu, James R. Glass, Helen M. Meng
2025ACLDecoding on Graphs: Faithful and Sound Reasoning on Knowledge Graphs through Generation of Well-Formed Chains.Kun Li, Tianhua Zhang, Xixin Wu, Hongyin Luo, James R. Glass, Helen M. Meng
2025ACLAutoregressive Speech Synthesis without Vector Quantization.Lingwei Meng, Long Zhou, Shujie Liu, Sanyuan Chen, Bing Han, Shujie Hu, Yanqing Liu, Jinyu Li, Sheng Zhao, Xixin Wu, Helen M. Meng, Furu Wei
2025ACLSocialCC: Interactive Evaluation for Cultural Competence in Language Agents.Jincenzi Wu, Jianxun Lian, Dingdong Wang, Helen M. Meng
2025ACLSelf-Tuning: Instructing LLMs to Effectively Acquire New Knowledge through Self-Teaching.Xiaoying Zhang, Baolin Peng, Ye Tian, Jingyan Zhou, Yipeng Zhang, Haitao Mi, Helen M. Meng
2025EMNLPRAG-Zeval: Enhancing RAG Responses Evaluator through End-to-End Reasoning and Ranking-Based Reinforcement Learning.Kun Li, Yunxiang Li, Tianhua Zhang, Hongyin Luo, Xixin Wu, James R. Glass, Helen M. Meng
2025EMNLPSpeech Discrete Tokens or Continuous Features? A Comparative Analysis for Spoken Language Understanding in SpeechLLMs.Dingdong Wang, Junan Li, Mingyu Cui, Dongchao Yang, Xueyuan Chen, Helen M. Meng
2025ICMLALMTokenizer: A Low-bitrate and Semantic-rich Audio Codec Tokenizer for Audio Language Modeling.Dongchao Yang, Songxiang Liu, Haohan Guo, Jiankun Zhao, Yuanyuan Wang, Helin Wang, Zeqian Ju, Xubo Liu, Xueyuan Chen, Xu Tan, Xixin Wu, Helen M. Meng
2024ICMLUniAudio: Towards Universal Audio Generation with Large Language Models.Dongchao Yang, Jinchuan Tian, Xu Tan, Rongjie Huang, Songxiang Liu, Haohan Guo, Xuankai Chang, Jiatong Shi, Sheng Zhao, Jiang Bian, Zhou Zhao, Xixin Wu, Helen M. Meng
2023ICASSPFeature Selection and Text Embedding for Detecting Dementia from Spontaneous Cantonese.Xiaoquan Ke, Man-Wai Mak, Helen M. Meng
2022InterspeechAutomatic Selection of Discriminative Features for Dementia Detection in Cantonese-Speaking People.Xiaoquan Ke, Man-Wai Mak, Helen M. Meng
2021ICASSPNon-Autoregressive Transformer ASR with CTC-Enhanced Decoder Input.Xingchen Song, Zhiyong Wu, Yiheng Huang, Chao Weng, Dan Su, Helen M. Meng
2021ICASSPSyntactic Representation Learning For Neural Network Based TTS with Syntactic Parse Tree Traversal.Changhe Song, Jingbei Li, Yixuan Zhou, Zhiyong Wu, Helen M. Meng
2017AAAIMulti-Task Deep Learning for User Intention Understanding in Speech Interaction Systems.Yishuang Ning, Jia Jia, Zhiyong Wu, Runnan Li, Yongsheng An, Yanfeng Wang, Helen M. Meng
2017ICASSPMulti-task learning of structured output layer bidirectional LSTMS for speech synthesis.Runnan Li, Zhiyong Wu, Xunying Liu, Helen M. Meng, Lianhong Cai
2017ICASSPLearning cross-lingual knowledge with multilingual BLSTM for emphasis detection with limited training data.Yishuang Ning, Zhiyong Wu, Runnan Li, Jia Jia, Mingxing Xu, Helen M. Meng, Lianhong Cai
2017IJCNNA model of extended paragraph vector for document categorization and trend analysis.Pengfei Liu, King Keung Wu, Helen M. Meng
2016ICASSPExploring articulatory characteristics of Cantonese dysarthric speech using distinctive features.Ka-Ho Wong, Wing Sum Yeung, Yu Ting Yeung, Helen M. Meng
2016InterspeechPhoneme Embedding and its Application to Speech Driven Talking Avatar Synthesis.Xu Li, Zhiyong Wu, Helen M. Meng, Jia Jia, Xiaoyan Lou, Lianhong Cai
2016InterspeechExpressive Speech Driven Talking Avatar Synthesis with DBLSTM Using Limited Amount of Emotional Bimodal Data.Xu Li, Zhiyong Wu, Helen M. Meng, Jia Jia, Xiaoyan Lou, Lianhong Cai
2016InterspeechCombining CNN and BLSTM to Extract Textual and Acoustic Features for Recognizing Stances in Mandarin Ideological Debate Competition.Linchuan Li, Zhiyong Wu, Mingxing Xu, Helen M. Meng, Lianhong Cai
2016InterspeechPersonalized, Cross-Lingual TTS Using Phonetic Posteriorgrams.Lifa Sun, Hao Wang, Shiyin Kang, Kun Li, Helen M. Meng
2016InterspeechAnalysis on Gated Recurrent Unit Based Question Detection Approach.Yaodong Tang, Zhiyong Wu, Helen M. Meng, Mingxing Xu, Lianhong Cai
2016SMCAn embedding approach for context-aware collaborative recommendation and visualization.King Keung Wu, Pengfei Liu, Helen M. Meng, Yeung Yam
2016SMCKronecker product approximation with multiple factor matrices via the tensor product algorithm.King Keung Wu, Yeung Yam, Helen M. Meng, Mehran Mesbahi
2015ACIIUnderstanding speaking styles of internet speech data with LSTM and low-resource training.Xixin Wu, Zhiyong Wu, Yishuang Ning, Jia Jia, Lianhong Cai, Helen M. Meng
2015BigDataIndoor Air Monitoring Platform and Personal Health Reporting System: Big Data Analytics for Public Health Research.Kin Fai Ho, Hoyee W. Hirai, Yong-Hong Kuo, Helen M. Meng, Kelvin Kam-fai Tsoi
2015BigDataA Real-Time Decision Support Tool for Disaster Response: A Mathematical Programming Approach.Yong-Hong Kuo, Janny M. Y. Leung, Helen M. Meng, Kelvin Kam-fai Tsoi
2015BigDataEmbracing Big Data for Simulation Modelling of Emergency Department Processes and Activities.Yong-Hong Kuo, Janny M. Y. Leung, Kelvin Kam-fai Tsoi, Helen M. Meng, Colin A. Graham
2015BigDataA Data Capturing Platform in the Cloud for Behavioral Analysis among Smokers: An Application Platform for Public Health Research.Kelvin Kam-fai Tsoi, Yong-Hong Kuo, Helen M. Meng
2015BigDataBlood Pressure Management with Data Capturing in the Cloud among Hypertensive Patients: A Monitoring Platform for Hypertensive Patients.Benjamin Yip, Hoyee W. Hirai, Yong-Hong Kuo, Helen M. Meng, Samuel Y. S. Wong, Kelvin Kam-fai Tsoi
2015EMNLPFine-grained Opinion Mining with Recurrent Neural Networks and Word Embeddings.Pengfei Liu, Shafiq R. Joty, Helen M. Meng
2015ICASSPA deep recurrent approach for acoustic-to-articulatory inversion.Peng Liu, Quanjie Yu, Zhiyong Wu, Shiyin Kang, Helen M. Meng, Lianhong Cai
2015ICASSPHMM-based emphatic speech synthesis for corrective feedback in computer-aided pronunciation training.Yishuang Ning, Zhiyong Wu, Jia Jia, Fanbo Meng, Helen M. Meng, Lianhong Cai
2015ICASSPVoice conversion using deep Bidirectional Long Short-Term Memory based Recurrent Neural Networks.Lifa Sun, Shiyin Kang, Kun Li, Helen M. Meng
2015InterspeechTopic modeling for conference analytics.Pengfei Liu, Shoaib Jameel, Wai Lam, Bin Ma, Helen M. Meng
2015InterspeechUsing tilt for automatic emphasis detection with Bayesian networks.Yishuang Ning, Zhiyong Wu, Xiaoyan Lou, Helen M. Meng, Jia Jia, Lianhong Cai
2015InterspeechE-commu-book: an assistive technology for users with speech impairments.Ka-Ho Wong, Wai-Kim Leung, Helen M. Meng
2015InterspeechDevelopment of a Cantonese dysarthric speech corpus.Ka-Ho Wong, Yu Ting Yeung, Edwin H. Y. Chan, Patrick C. M. Wong, Gina-Anne Levow, Helen M. Meng
2015InterspeechImproving automatic forced alignment for dysarthric speech transcription.Yu Ting Yeung, Ka-Ho Wong, Helen M. Meng
2014InterspeechStatistical parametric speech synthesis using weighted multi-distribution deep belief network.Shiyin Kang, Helen M. Meng
2014InterspeechUsing conditional random fields to predict focus word pair in spontaneous spoken English.Xiao Zang, Zhiyong Wu, Helen M. Meng, Jia Jia, Lianhong Cai
2014InterspeechPLDA modeling in the fishervoice subspace for speaker verification.Jinghua Zhong, Weiwu Jiang, Wei Rao, Man-Wai Mak, Helen M. Meng
2013ICASSPClustering similar acoustic classes in the Fishervoice framework.Na Li, Weiwu Jiang, Helen M. Meng, Zhifeng Li
2013ICASSPAudiovisual synthesis of exaggerated speech for corrective feedback in computer-assisted pronunciation training.Junhong Zhao, Hua Yuan, Wai-Kim Leung, Helen M. Meng, Jia Liu, Shanhong Xia
2013ICASSPInvestigation of tandem deep belief network approach for phoneme recognition.Xin Zheng, Zhiyong Wu, Binbin Shen, Helen M. Meng, Lianhong Cai
2012InterspeechHierarchical English Emphatic Speech Synthesis Based on HMM with Limited Training Data.Fanbo Meng, Zhiyong Wu, Helen M. Meng, Jia Jia, Lianhong Cai
2012InterspeechThe Use of DBN-HMMs for Mispronunciation Detection and Diagnosis in L2 English to Support Computer-Aided Pronunciation Training.Xiaojun Qian, Helen M. Meng, Frank K. Soong
2011ICASSPThe HKCUPU system for the NIST 2010 speaker recognition evaluation.Weiwu Jiang, Man-Wai Mak, Wei Rao, Helen M. Meng
2011ICASSPAllophonic variations in visual speech synthesis for corrective feedback in CAPT.Ka-Ho Wong, Wai Kit Lo, Helen M. Meng
2011InterspeechAn Analysis Framework Based on Random Subspace Sampling for Speaker Verification.Weiwu Jiang, Zhifeng Li, Helen M. Meng
2011InterspeechProminence Model for Prosodic Features in Automatic Lexical Stress and Pitch Accent Detection.Kun Li, Shuang Zhang, Mingxing Li, Wai Kit Lo, Helen M. Meng
2011InterspeechOn Mispronunciation Lexicon Generation Using Joint-Sequence Multigrams in Computer-Aided Pronunciation Training (CAPT).Xiaojun Qian, Helen M. Meng, Frank K. Soong
2010ICASSPFishervioce: A discriminant subspace framework for speaker recognition.Zhifeng Li, Weiwu Jiang, Helen M. Meng
2010ICASSPStatistical phone duration modeling to filter for intact utterances in a computer-assisted pronunciation training system.Wai Kit Lo, Alissa M. Harrison, Helen M. Meng
2010InterspeechAutomatic derivation of phonological rules for mispronunciation detection in a computer-assisted pronunciation training system.Wai Kit Lo, Shuang Zhang, Helen M. Meng
2010InterspeechDiscriminative acoustic model for improving mispronunciation detection and diagnosis in computer-aided pronunciation training (CAPT).Xiaojun Qian, Frank K. Soong, Helen M. Meng
2010IUIUsage patterns and latent semantic analyses for task goal inference of multimodal user interactions.Pui-Yu Hui, Wai Kit Lo, Helen M. Meng
2009ACLAutomatic Story Segmentation using a Bayesian Decision Framework for Statistical Models of Lexical Chain Features.Wai Kit Lo, Wenying Xiong, Helen M. Meng
2008ICASSPRecasting the discriminative n-gram model as a pseudo-conventional n-gram model for LVCSR.Zhengyu Zhou, Helen M. Meng
2008InterspeechImproving mispronunciation detection and diagnosis of learners' speech with context-sensitive phonological rules based on language transfer.Alissa M. Harrison, Wing Yiu Lau, Helen M. Meng, Lan Wang
2008InterspeechAutomatic generation and pruning of phonetic mispronunciations to support computer-aided pronunciation training.Lan Wang, Xin Feng, Helen M. Meng
2007ACIIFacial Expression Synthesis Using PAD Emotional Parameters for a Chinese Expressive Avatar.Shen Zhang, Zhiyong Wu, Helen M. Meng, Lianhong Cai
2007CVPRDiscriminant Mutual Subspace Learning for Indoor and Outdoor Face Recognition.Zhifeng Li, Dahua Lin, Helen M. Meng, Xiaoou Tang
2007ICASSPAdaptive Weight Estimation in Multi-Biometric Verification using Fuzzy Logic Decision Fusion.Henry Pak-Sum Hui, Helen M. Meng, Man-Wai Mak
2007ICASSPEffects of Device Mismatch, Language Mismatch and Environmental Mismatch on Speaker Verification.Bin Ma, Helen M. Meng, Man-Wai Mak
2007ICASSPHead Movement Synthesis Based on Semantic and Prosodic Features for a Chinese Expressive Avatar.Shen Zhang, Zhiyong Wu, Helen M. Meng, Lianhong Cai
2007InterspeechModeling the statistical behavior of lexical chains to capture word cohesiveness for automatic story segmentation.Shing-kai Chan, Lei Xie, Helen M. Meng
2007InterspeechComplementarity and redundancy in multimodal user inputs with speech and pen gestures.Pui-Yu Hui, Zhengyu Zhou, Helen M. Meng
2007InterspeechHigh-level feature-based speaker verification via articulatory phonetic-class pronunciation modeling.Shi-Xiong Zhang, Man-Wai Mak, Helen M. Meng
2006InterspeechJoint interpretation of input speech and pen gestures for multimodal human-computer interaction.Pui-Yu Hui, Helen M. Meng
2006InterspeechReal-time synthesis of Chinese visual speech and facial expressions using MPEG-4 FAP features in a three-dimensional avatar.Zhiyong Wu, Shen Zhang, Lianhong Cai, Helen M. Meng
2006InterspeechModeling the acoustic correlates of expressive elements in text genres for expressive text-to-speech synthesis.Hongwu Yang, Helen M. Meng, Lianhong Cai
2006InterspeechA multi-pass error detection and correction framework for Mandarin LVCSR.Zhengyu Zhou, Helen M. Meng, Wai Kit Lo
2006NAACLA Maximum Entropy Framework that Integrates Word Dependencies and Grammatical Relations for Reading Comprehension.Kui Xu, Helen M. Meng, Fuliang Weng
2005InterspeechEmbedded Cantonese TTS for multi-device access to web content.Tien Ying Fung, Yuk-Chi Li, Eddie Sio, Icarus Lee, Helen M. Meng, P. C. Ching
2004InterspeechA two-level schema for detecting recognition errors.Zhengyu Zhou, Helen M. Meng
2003ICASSPMultimedia fusion in automatic extraction of studio speech segments for spoken document retrieval.Pui-Yu Hui, Wai Kit Lo, Helen M. Meng
2003InterspeechMulti-scale document expansion in English-Mandarin cross-language spoken document retrieval.Wai Kit Lo, Yuk-Chi Li, Gina-Anne Levow, Hsin-Min Wang, Helen M. Meng
2003InterspeechRecent enhancements in CU VOCAL for Chinese TTS-enabled applications.Helen M. Meng, Yuk-Chi Li, Tien Ying Fung, Man Cheuk Ho, Chi-Kin Keung, Tin Hang Lo, Wai Kit Lo, P. C. Ching
2003InterspeechNatural language response generation in mixed-initiative dialogs using task goals and dialog acts.Helen M. Meng, Wing Lin Yip, Oi Yan Mok, Shuk Fong Chan
2003InterspeechExample-based bi-directional Chinese-English machine translation with semi-automatically induced grammars.Kai-Chung Siu, Helen M. Meng, Chin-Chung Wong
2003WWWCU VOCAL Web Service: A Text-to-speech Synthesis Web Service for Voice-enabled Web-mediated Applications.Helen M. Meng, Tin Hang Lo, Chi-Kin Keung, Man Cheuk Ho, Wai Kit Lo, P. C. Ching
2002InterspeechMulti-scale and multi-model integration for improved performance in Chinese spoken document retrieval.Wai Kit Lo, Helen M. Meng, P. C. Ching
2002InterspeechISIS: a multi-modal, trilingual, distributed spoken dialog system developed with CORBA, java, XML and KQML.Helen M. Meng, P. C. Ching, Yee Fong Wong, Cheong Chat Chan
2002InterspeechCU VOCAL: corpus-based syllable concatenation for Chinese speech synthesis across domains and dialects.Helen M. Meng, Chi-Kin Keung, Kai-Chung Siu, Tien Ying Fung, P. C. Ching
2001ICASSPSpeech retrieval with video parsing for television news programs.Helen M. Meng, Xiaoou Tang, Pui-Yu Hui, Xinbo Gao, Yuk-Chi Li
2001ICASSPA dynamic semantic model for re-scoring recognition hypotheses.Carmen Wai, Roberto Pieraccini, Helen M. Meng
2001ICASSPMulti-scale-audio indexing for translingual spoken document retrieval.Hsin-Min Wang, Helen M. Meng, Patrick Schone, Berlin Chen, Wai-Kit Lo
2001InterspeechMulti-scale retrieval in MEI: an English-Chinese translingual speech retrieval system.Wai Kit Lo, Patrick Schone, Helen M. Meng
2001InterspeechISIS: a learning system with combined interaction and delegation dialogs.Helen M. Meng, Shuk Fong Chan, Yee Fong Wong, Cheong Chat Chan, Yiu Wing Wong, Tien Ying Fung, Wai Ching Tsui, Ke Chen, Lan Wang, Ting-Yao Wu, Xiaolong Li, Tan Lee, Wing Nin Choi, P. C. Ching, Huisheng Chi
2001InterspeechSemi-automatic grammar induction for bi-directional English-Chinese machine translation.Kai-Chung Siu, Helen M. Meng
2001InterspeechMulti-parser architecture for query processing.Kui Xu, Fuliang Weng, Helen M. Meng, Po-Chui Luk
2001NAACLMandarin-English Information: Investigating Translingual Speech Retrieval.Helen M. Meng, Berlin Chen, Sanjeev Khudanpur, Gina-Anne Levow, Wai-Kit Lo, Douglas W. Oard, Patrick Schone, Karen Tang, Hsin-Min Wang, Jianqiang Wang
2001NAACLScalability and Portability of a Belief Network-based Dialog Model for Different Application Domains.Carmen Wai, Helen M. Meng, Roberto Pieraccini
2000ICASSPConcatenating syllables for response generation in spoken language applications.Tien Ying Fung, Helen M. Meng
2000ICASSPCU FOREX: a bilingual spoken dialog system for foreign exchange enquiries.Helen M. Meng, Steven Lee, Carmen Wai
2000InterspeechGrammar partitioning and parser composition for natural language understanding.Po-Chui Luk, Helen M. Meng, Filung Wang
2000InterspeechISIS: A multilingual spoken dialog system developed with CORBA and KQML agents.Helen M. Meng, Shuk Fong Chan, Yee Fong Wong, Tien Ying Fung, Wai Ching Tsui, Tin Hang Lo, Cheong Chat Chan, Ke Chen, Lan Wang, Ting-Yao Wu, Xiaolong Li, Tan Lee, Wing Nin Choi, Yiu Wing Wong, P. C. Ching, Huisheng Chi
2000InterspeechMulti-scale audio indexing for Chinese spoken document retrieval.Helen M. Meng, Wai Kit Lo, Yuk-Chi Li, P. C. Ching
2000InterspeechThe use of belief networks for mixed-initiative dialog modeling.Helen M. Meng, Carmen Wai, Roberto Pieraccini
1999InterspeechMicro-prosodic control in cantonese text-to-speech synthesis.Tan Lee, Helen M. Meng, Wai H. Lau, Wai Kit Lo, P. C. Ching
1999InterspeechTo believe is to understand.Helen M. Meng, Wai Lam, Carmen Wai
1999InterspeechSemi-automatic acquisition of domain-specific semantic structures.Kai-Chung Siu, Helen M. Meng
1997InterspeechYINHE: a Mandarin Chinese version of the GALAXY system.Chao Wang, James R. Glass, Helen M. Meng, Joseph Polifroni, Stephanie Seneff, Victor W. Zue
1997InterspeechFrom interface to content: translingual access and delivery of on-line information.Victor W. Zue, Stephanie Seneff, James R. Glass, I. Lee Hetherington, Edward Hurley, Helen M. Meng, Christine Pao, Joseph Polifroni, Rafael Schloming, Philipp Schmid
1996InterspeechA form-based dialogue manager for spoken language applications.David Goddeau, Helen M. Meng, Joseph Polifroni, Stephanie Seneff, Senis Busayapongchai
1996InterspeechWHEELS: a conversational system in the automobile classifieds domain.Helen M. Meng, Senis Busayapongchai, James R. Glass, David Goddeau, I. Lee Hetherington, Edward Hurley, Christine Pao, Joseph Polifroni, Stephanie Seneff, Victor Zue
1996InterspeechANGIE: a new framework for speech analysis based on morpho-phonological modelling.Stephanie Seneff, Raymond Lau, Helen M. Meng
1996InterspeechMultilingual human-computer interactions: from information access to language learning.Victor Zue, Stephanie Seneff, Joseph Polifroni, Helen M. Meng, James R. Glass
1994ICASSPPhonological parsing for reversible letter-to-sound/sound-to-letter generation.Helen M. Meng, Stephanie Seneff, Victor W. Zue
1994NAACLPhonological Parsing for Bi-directional Letter-to-Sound/Sound-to-Letter Generation.Helen M. Meng, Stephanie Seneff, Victor Zue
1993InterspeechReversible letter-to-sound sound-to-letter generation based on parsing word morphology.Sheri Hunnicutt, Helen M. Meng, Stephanie Seneff, Victor W. Zue
1992InterspeechLanguage modelling for recognition and understanding using layered bigrams.Stephanie Seneff, Helen M. Meng, Victor Zue
1991ICASSPSignal representation comparison for phonetic classification.Helen M. Meng, Victor W. Zue
1991NAACLSignal Representation Attribute Extraction and the Use Distinctive Features for Phonetic Classification.Helen M. Meng, Victor Zue, Hong C. Leung
1990InterspeechA comparative study of acoustic representations of speech for vowel classification using multi-layer perceptrons.Helen M. Meng, Victor W. Zue