Skip to content

Helen Meng

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

222

Venues

17

Active years

2004–2026

Best venue rank

A*

Where they publish

Papers

222 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIDualSpeechLM: Towards Unified Speech Understanding and Generation via Dual Speech Token Modeling with Large Language Models.Yuanyuan Wang, Dongchao Yang, Yiwen Shao, Hangting Chen, Jiankun Zhao, Zhiyong Wu, Helen Meng, Xixin Wu
2025ICASSPDisentangling Speakers in Multi-Talker Speech Recognition with Speaker-Aware CTC.Jiawen Kang, Lingwei Meng, Mingyu Cui, Yuejiao Wang, Xixin Wu, Xunying Liu, Helen Meng
2025ICASSPSpeaking from Coarse to Fine: Improving Neural Codec Language Model via Multi-Scale Speech Coding and Generation.Haohan Guo, Fenglong Xie, Dongchao Yang, Xixin Wu, Helen Meng
2025ICASSPSpectral-Aware Low-Rank Adaptation for Speaker Verification.Zhe Li, Man-Wai Mak, Mert Pilanci, Hung-yi Lee, Helen Meng
2025ICASSPLarge Language Model Can Transcribe Speech in Multi-Talker Scenarios with Versatile Instructions.Lingwei Meng, Shujie Hu, Jiawen Kang, Zhaoqing Li, Yuejiao Wang, Wenxuan Wu, Xixin Wu, Xunying Liu, Helen Meng
2025ICASSPIntegrating Potential Pronunciations for Enhanced Mispronunciation Detection and Diagnosis Ability in LLMs.Minglin Wu, Jing Xu, Xueyuan Chen, Helen Meng
2025InterspeechOn the Within-class Variation Issue in Alzheimer's Disease Detection.Jiawen Kang, Dongrui Han, Lingwei Meng, Jingyan Zhou, Jinchao Li, Xixin Wu, Helen Meng
2025InterspeechDisentangling Speaker and Content in Pre-trained Speech Models with Latent Diffusion for Robust Speaker Verification.Zhe Li, Man-Wai Mak, Jen-Tzung Chien, Mert Pilanci, Zezhong Jin, Helen Meng
2025InterspeechDiffDSR: Dysarthric Speech Reconstruction Using Latent Diffusion Model.Xueyuan Chen, Dongchao Yang, Wenxuan Wu, Minglin Wu, Jing Xu, Xixin Wu, Zhiyong Wu, Helen Meng
2025InterspeechOn-the-fly Routing for Zero-shot MoE Speaker Adaptation of Speech Foundation Models for Dysarthric Speech Recognition.Shujie Hu, Xurong Xie, Mengzhe Geng, Jiajun Deng, Huimeng Wang, Guinan Li, Chengxi Deng, Tianzi Wang, Mingyu Cui, Helen Meng, Xunying Liu
2025InterspeechOptimizing Pause Context in Fine-Tuning Pre-trained Large Language Models for Dementia Detection.Xiaoquan Ke, Man-Wai Mak, Helen Meng
2025InterspeechIncorporating Linguistic Constraints from External Knowledge Source for Audio-Visual Target Speech Extraction.Wenxuan Wu, Shuai Wang, Xixin Wu, Helen Meng, Haizhou Li
2025InterspeechDefending Unauthorized Voice Cloning with Watermark-Aware Codecs.Jiankun Zhao, Lingwei Meng, Chengxi Deng, Helen Meng, Xixin Wu
2024AAAISimCalib: Graph Neural Network Calibration Based on Similarity between Nodes.Boshi Tang, Zhiyong Wu, Xixin Wu, Qiaochu Huang, Jun Chen, Shun Lei, Helen Meng
2024ACLCOKE: A Cognitive Knowledge Graph for Machine Theory of Mind.Jincenzi Wu, Zhuang Chen, Jiawen Deng, Sahand Sabour, Helen Meng, Minlie Huang
2024ACLSelf-Alignment for Factuality: Mitigating Hallucinations in LLMs via Self-Evaluation.Xiaoying Zhang, Baolin Peng, Ye Tian, Jingyan Zhou, Lifeng Jin, Linfeng Song, Haitao Mi, Helen Meng
2024CHIDesigning Scaffolding Strategies for Conversational Agents in Dialog Task of Neurocognitive Disorders Screening.Jiaxiong Hu, Junze Li, Yuhang Zeng, Dongjie Yang, Danxuan Liang, Helen Meng, Xiaojuan Ma
2024CIKMNatural Language-Assisted Multi-modal Medication Recommendation.Jie Tan, Yu Rong, Kangfei Zhao, Tian Bian, Tingyang Xu, Junzhou Huang, Hong Cheng, Helen Meng
2024EMNLPAdaptive Query Rewriting: Aligning Rewriters through Marginal Probability of Conversational Answers.Tianhua Zhang, Kun Li, Hongyin Luo, Xixin Wu, James R. Glass, Helen Meng
2024ICASSPCross-Speaker Encoding Network for Multi-Talker Speech Recognition.Jiawen Kang, Lingwei Meng, Mingyu Cui, Haohan Guo, Xixin Wu, Xunying Liu, Helen Meng
2024ICASSPExploiting Audio-Visual Features with Pretrained AV-HuBERT for Multi-Modal Dysarthric Speech Reconstruction.Xueyuan Chen, Yuejiao Wang, Xixin Wu, Disong Wang, Zhiyong Wu, Xunying Liu, Helen Meng
2024ICASSPStylespeech: Self-Supervised Style Enhancing with VQ-VAE-Based Pre-Training for Expressive Audiobook Speech Synthesis.Xueyuan Chen, Xi Wang, Shaofei Zhang, Lei He, Zhiyong Wu, Xixin Wu, Helen Meng
2024ICASSPEnhancing Expressiveness in Dance Generation Via Integrating Frequency and Music Style Information.Qiaochu Huang, Xu He, Boshi Tang, Haolin Zhuang, Liyang Chen, Shuochen Gao, Zhiyong Wu, Haozhi Huang, Helen Meng
2024ICASSPImproving Language Model-Based Zero-Shot Text-to-Speech Synthesis with Multi-Scale Acoustic Prompts.Shun Lei, Yixuan Zhou, Liyang Chen, Dan Luo, Zhiyong Wu, Xixin Wu, Shiyin Kang, Tao Jiang, Yahui Zhou, Yuxing Han, Helen Meng
2024ICASSPMulti-View Midivae: Fusing Track- and Bar-View Representations for Long Multi-Track Symbolic Music Generation.Zhiwei Lin, Jun Chen, Boshi Tang, Binzhu Sha, Jing Yang, Yaolong Ju, Fan Fan, Shiyin Kang, Zhiyong Wu, Helen Meng
2024ICASSPUnifying One-Shot Voice Conversion and Cloning with Disentangled Speech Representations.Hui Lu, Xixin Wu, Haohan Guo, Songxiang Liu, Zhiyong Wu, Helen Meng
2024ICASSPNeural Concatenative Singing Voice Conversion: Rethinking Concatenation-Based Approach for One-Shot Singing Voice Conversion.Binzhu Sha, Xu Li, Zhiyong Wu, Ying Shan, Helen Meng
2024ICASSPSCNet: Sparse Compression Network for Music Source Separation.Weinan Tong, Jiaxu Zhu, Jun Chen, Shiyin Kang, Tao Jiang, Yang Li, Zhiyong Wu, Helen Meng
2024ICASSPConsistent and Relevant: Rethink the Query Embedding in General Sound Separation.Yuanyuan Wang, Hangting Chen, Dongchao Yang, Jianwei Yu, Chao Weng, Zhiyong Wu, Helen Meng
2024ICASSPUNIT-DSR: Dysarthric Speech Reconstruction System Using Speech Unit Normalization.Yuejiao Wang, Xixin Wu, Disong Wang, Lingwei Meng, Helen Meng
2024ICASSPConversational Co-Speech Gesture Generation via Modeling Dialog Intention, Emotion, and Context with Diffusion Models.Haiwei Xue, Sicheng Yang, Zhensong Zhang, Zhiyong Wu, Minglei Li, Zonghong Dai, Helen Meng
2024IJCNNTarget Speech Extraction with Pre-trained AV-HuBERT and Mask-And-Recover Strategy.Wenxuan Wu, Xueyuan Chen, Xixin Wu, Haizhou Li, Helen Meng
2024InterspeechLoRA-MER: Low-Rank Adaptation of Pre-Trained Speech Models for Multimodal Emotion Recognition Using Mutual Information.Yunrui Cai, Zhiyong Wu, Jia Jia, Helen Meng
2024InterspeechCoLM-DSR: Leveraging Neural Codec Language Modeling for Multi-Modal Dysarthric Speech Reconstruction.Xueyuan Chen, Dongchao Yang, Dingdong Wang, Xixin Wu, Zhiyong Wu, Helen Meng
2024InterspeechJoint Speaker Features Learning for Audio-visual Multichannel Speech Separation and Recognition.Guinan Li, Jiajun Deng, Youjun Chen, Mengzhe Geng, Shujie Hu, Zhe Li, Zengrui Jin, Tianzi Wang, Xurong Xie, Helen Meng, Xunying Liu
2024InterspeechParameter-efficient Fine-tuning of Speaker-Aware Dynamic Prompts for Speaker Verification.Zhe Li, Man-Wai Mak, Hung-yi Lee, Helen Meng
2024InterspeechSpontaneous Style Text-to-Speech Synthesis with Controllable Spontaneous Behaviors Based on Language Models.Weiqin Li, Peiji Yang, Yicheng Zhong, Yixuan Zhou, Zhisheng Wang, Zhiyong Wu, Xixin Wu, Helen Meng
2024InterspeechEmpowering Whisper as a Joint Multi-Talker and Target-Talker Speech Recognition System.Lingwei Meng, Jiawen Kang, Yuejiao Wang, Zengrui Jin, Xixin Wu, Xunying Liu, Helen Meng
2024InterspeechLarge Language Model-based FMRI Encoding of Language Functions for Subjects with Neurocognitive Disorder.Yuejiao Wang, Xianmin Gong, Lingwei Meng, Xixin Wu, Helen Meng
2024InterspeechTowards Effective and Efficient Non-autoregressive Decoding Using Block-based Attention Mask.Tianzi Wang, Xurong Xie, Zhaoqing Li, Shoukang Hu, Zengrui Jin, Jiajun Deng, Mingyu Cui, Shujie Hu, Mengzhe Geng, Guinan Li, Helen Meng, Xunying Liu
2024InterspeechPrompting Large Language Models with Mispronunciation Detection and Diagnosis Abilities.Minglin Wu, Jing Xu, Xixin Wu, Helen Meng
2024InterspeechSeamless Language Expansion: Enhancing Multilingual Mastery in Self-Supervised Models.Jing Xu, Minglin Wu, Xixin Wu, Helen Meng
2024InterspeechSimpleSpeech: Towards Simple and Efficient Text-to-Speech with Scalar Latent Transformer Diffusion Models.Dongchao Yang, Dingdong Wang, Haohan Guo, Xueyuan Chen, Xixin Wu, Helen Meng
2024NAACLNatural Language Embedded Programs for Hybrid Language Symbolic Reasoning.Tianhua Zhang, Jiaxin Ge, Hongyin Luo, Yung-Sung Chuang, Mingye Gao, Yuan Gong, Yoon Kim, Xixin Wu, Helen Meng, Jim Glass
2024NAACLRethinking Machine Ethics - Can LLMs Perform Moral Reasoning through the Lens of Moral Theories?Jingyan Zhou, Minda Hu, Junan Li, Xiaoying Zhang, Xixin Wu, Irwin King, Helen Meng
2023EMNLPSearch Augmented Instruction Learning.Hongyin Luo, Tianhua Zhang, Yung-Sung Chuang, Yuan Gong, Yoon Kim, Xixin Wu, Helen Meng, James R. Glass
2023EMNLPSGP-TOD: Building Task Bots Effortlessly via Schema-Guided LLM Prompting.Xiaoying Zhang, Baolin Peng, Kun Li, Jingyan Zhou, Helen Meng
2023ICASSPInter-Subnet: Speech Enhancement with Subband Interaction.Jun Chen, Wei Rao, Zilin Wang, Jiuxin Lin, Zhiyong Wu, Yannan Wang, Shidong Shang, Helen Meng
2023ICASSPExploring Self-Supervised Pre-Trained ASR Models for Dysarthric and Elderly Speech Recognition.Shujie Hu, Xurong Xie, Zengrui Jin, Mengzhe Geng, Yi Wang, Mingyu Cui, Jiajun Deng, Xunying Liu, Helen Meng
2023ICASSPContext-Aware Coherent Speaking Style Prediction with Hierarchical Transformers for Audiobook Speech Synthesis.Shun Lei, Yixuan Zhou, Liyang Chen, Zhiyong Wu, Shiyin Kang, Helen Meng
2023ICASSPAv-Sepformer: Cross-Attention Sepformer for Audio-Visual Target Speaker Extraction.Jiuxin Lin, Xinyu Cai, Heinrich Dinkel, Jun Chen, Zhiyong Yan, Yongqing Wang, Junbo Zhang, Zhiyong Wu, Yujun Wang, Helen Meng
2023ICASSPLeveraging Pretrained Representations With Task-Related Keywords for Alzheimer's Disease Detection.Jinchao Li, Kaitao Song, Junan Li, Bo Zheng, Dongsheng Li, Xixin Wu, Xunying Liu, Helen Meng
2023ICASSPA Hierarchical Regression Chain Framework for Affective Vocal Burst Recognition.Jinchao Li, Xixin Wu, Kaitao Song, Dongsheng Li, Xunying Liu, Helen Meng
2023ICASSPA Sidecar Separator Can Convert A Single-Talker Speech Recognition System to A Multi-Talker One.Lingwei Meng, Jiawen Kang, Mingyu Cui, Yuejiao Wang, Xixin Wu, Helen Meng
2023ICASSPContrastive Learning with Dialogue Attributes for Neural Dialogue Generation.Jie Tan, Hengyi Cai, Hongshen Chen, Hong Cheng, Helen Meng, Zhuoye Ding
2023ICASSPTFCnet: Time-Frequency Domain Corrector for Speech Separation.Weinan Tong, Jiaxu Zhu, Jun Chen, Zhiyong Wu, Shiyin Kang, Helen Meng
2023ICASSPExploiting Prompt Learning with Pre-Trained Language Models for Alzheimer's Disease Detection.Yi Wang, Jiajun Deng, Tianzi Wang, Bo Zheng, Shoukang Hu, Xunying Liu, Helen Meng
2023ICASSPA Synthetic Corpus Generation Method for Neural Vocoder Training.Zilin Wang, Peng Liu, Jun Chen, Sipan Li, Jinfeng Bai, Gang He, Zhiyong Wu, Helen Meng
2023ICASSPDASA: Difficulty-Aware Semantic Augmentation for Speaker Verification.Yuanyuan Wang, Yang Zhang, Zhiyong Wu, Zhihan Yang, Tao Wei, Kun Zou, Helen Meng
2023ICASSPCB-Conformer: Contextual Biasing Conformer for Biased Word Recognition.Yaoxun Xu, Baiji Liu, Qiaochu Huang, Xingchen Song, Zhiyong Wu, Shiyin Kang, Helen Meng
2023ICASSPKeyword-Specific Acoustic Model Pruning for Open-Vocabulary Keyword Spotting.Yujie Yang, Kun Zhang, Zhiyong Wu, Helen Meng
2023ICASSPEnhancing the Vocal Range of Single-Speaker Singing Voice Synthesis with Melody-Unsupervised Pre-Training.Shaohuan Zhou, Xu Li, Zhiyong Wu, Ying Shan, Helen Meng
2023ICASSPGTN-Bailando: Genre Consistent long-Term 3D Dance Generation Based on Pre-Trained Genre Token Network.Haolin Zhuang, Shun Lei, Long Xiao, Weiqin Li, Liyang Chen, Sicheng Yang, Zhiyong Wu, Shiyin Kang, Helen Meng
2023ICDEDecision Support System for Chronic Diseases Based on Drug-Drug Interactions.Tian Bian, Yuli Jiang, Jia Li, Tingyang Xu, Yu Rong, Yi Su, Timothy C. Y. Kwok, Helen Meng, Hong Cheng
2023InterspeechDiverse and Expressive Speech Prosody Prediction with Denoising Diffusion Probabilistic Model.Xiang Li, Songxiang Liu, Max W. Y. Lam, Zhiyong Wu, Chao Weng, Helen Meng
2023InterspeechOn-the-Fly Feature Based Rapid Speaker Adaptation for Dysarthric and Elderly Speech Recognition.Mengzhe Geng, Xurong Xie, Rongfeng Su, Jianwei Yu, Zengrui Jin, Tianzi Wang, Shujie Hu, Zi Ye, Helen Meng, Xunying Liu
2023InterspeechExploiting Cross-Domain And Cross-Lingual Ultrasound Tongue Imaging Features For Elderly And Dysarthric Speech Recognition.Shujie Hu, Xurong Xie, Mengzhe Geng, Mingyu Cui, Jiajun Deng, Guinan Li, Tianzi Wang, Helen Meng, Xunying Liu
2023InterspeechTowards Spontaneous Style Modeling with Semi-supervised Pre-training for Conversational Text-to-Speech Synthesis.Weiqin Li, Shun Lei, Qiaochu Huang, Yixuan Zhou, Zhiyong Wu, Shiyin Kang, Helen Meng
2023InterspeechPunCantonese: A Benchmark Corpus for Low-Resource Cantonese Punctuation Restoration from Speech Transcripts.Yunxiang Li, Pengfei Liu, Xixin Wu, Helen Meng
2023InterspeechUnified Modeling of Multi-Talker Overlapped Speech Recognition and Diarization with a Sidecar Separator.Lingwei Meng, Jiawen Kang, Mingyu Cui, Haibin Wu, Xixin Wu, Helen Meng
2023InterspeechIntegrated and Enhanced Pipeline System to Support Spoken Language Analytics for Screening Neurocognitive Disorders.Helen Meng, Brian Mak, Man-Wai Mak, Helene H. Fung, Xianmin Gong, Timothy C. Y. Kwok, Xunying Liu, Vincent C. T. Mok, Patrick C. M. Wong, Jean Woo, Xixin Wu, Ka Ho Wong, Sean Shensheng Xu, Naijun Zheng, Ranzo Huang, Jiawen Kang, Xiaoquan Ke, Junan Li, Jinchao Li, Yi Wang
2023InterspeechHyper-parameter Adaptation of Conformer ASR Systems for Elderly and Dysarthric Speech Recognition.Tianzi Wang, Shoukang Hu, Jiajun Deng, Zengrui Jin, Mengzhe Geng, Yi Wang, Helen Meng, Xunying Liu
2023InterspeechSememeASR: Boosting Performance of End-to-End Speech Recognition against Domain and Long-Tailed Data Shift with Sememe Semantic Knowledge.Jiaxu Zhu, Changhe Song, Zhiyong Wu, Helen Meng
2023InterspeechText-Only Domain Adaptation for End-to-End Speech Recognition through Down-Sampling Acoustic Representation.Jiaxu Zhu, Weinan Tong, Yaoxun Xu, Changhe Song, Zhiyong Wu, Zhao You, Dan Su, Dong Yu, Helen Meng
2022ACLOn Controlling Fallback Responses for Grounded Dialogue Generation.Hongyuan Lu, Wai Lam, Hong Cheng, Helen Meng
2022CHITalkTive: A Conversational Agent Using Backchannels to Engage Older Adults in Neurocognitive Disorders Screening.Zijian Ding, Jiawen Kang, Tinky Oi Ting Ho, Ka Ho Wong, Helene H. Fung, Helen Meng, Xiaojuan Ma
2022COLINGUnsupervised Multi-scale Expressive Speaking Style Modeling with Hierarchical Context Information for Audiobook Speech Synthesis.Xueyuan Chen, Shun Lei, Zhiyong Wu, Dong Xu, Weifeng Zhao, Helen Meng
2022EMNLPCOLD: A Benchmark for Chinese Offensive Language Detection.Jiawen Deng, Jingyan Zhou, Hao Sun, Chujie Zheng, Fei Mi, Helen Meng, Minlie Huang
2022EMNLPTowards Identifying Social Bias in Dialog Systems: Framework, Dataset, and Benchmark.Jingyan Zhou, Jiawen Deng, Fei Mi, Yitong Li, Yasheng Wang, Minlie Huang, Xin Jiang, Qun Liu, Helen Meng
2022ICASSPA Character-Level Span-Based Model for Mandarin Prosodic Structure Prediction.Xueyuan Chen, Changhe Song, Yixuan Zhou, Zhiyong Wu, Changbin Chen, Zhongqin Wu, Helen Meng
2022ICASSPFullSubNet+: Channel Attention Fullsubnet with Complex Spectrograms for Speech Enhancement.Jun Chen, Zilin Wang, Deyi Tuo, Zhiyong Wu, Shiyin Kang, Helen Meng
2022ICASSPAn End-to-End Chinese Text Normalization Model Based on Rule-Guided Flat-Lattice Transformer.Wenlin Dai, Changhe Song, Xiang Li, Zhiyong Wu, Huashan Pan, Xiulin Li, Helen Meng
2022ICASSPExploiting Cross Domain Acoustic-to-Articulatory Inverted Features for Disordered Speech Recognition.Shujie Hu, Shansong Liu, Xurong Xie, Mengzhe Geng, Tianzi Wang, Shoukang Hu, Mingyu Cui, Xunying Liu, Helen Meng
2022ICASSPTowards Expressive Speaking Style Modelling with Hierarchical Context Information for Mandarin Speech Synthesis.Shun Lei, Yixuan Zhou, Liyang Chen, Zhiyong Wu, Shiyin Kang, Helen Meng
2022ICASSPEnhancing Speaking Styles in Conversational Text-to-Speech Synthesis with Graph-Based Multi-Modal Context Modeling.Jingbei Li, Yi Meng, Chenyi Li, Zhiyong Wu, Helen Meng, Chao Weng, Dan Su
2022ICASSPNeufa: Neural Network Based End-to-End Forced Alignment with Bidirectional Attention Mechanism.Jingbei Li, Yi Meng, Zhiyong Wu, Helen Meng, Qiao Tian, Yuping Wang, Yuxuan Wang
2022ICASSPAudio-Visual Multi-Channel Speech Separation, Dereverberation and Recognition.Guinan Li, Jianwei Yu, Jiajun Deng, Xunying Liu, Helen Meng
2022ICASSPA Multitask Learning Framework for Speaker Change Detection with Content Information from Unsupervised Speech Decomposition.Hang Su, Danyang Zhao, Long Dang, Minglei Li, Xixin Wu, Xunying Liu, Helen Meng
2022ICASSPSpeaker Identity Preservation in Dysarthric Speech Reconstruction by Adversarial Speaker Adaptation.Disong Wang, Songxiang Liu, Xixin Wu, Hui Lu, Lifa Sun, Xunying Liu, Helen Meng
2022ICASSPVCVTS: Multi-Speaker Video-to-Speech Synthesis Via Cross-Modal Knowledge Transfer from Voice Conversion.Disong Wang, Shan Yang, Dan Su, Xunying Liu, Dong Yu, Helen Meng
2022ICASSPAdversarial Sample Detection for Speaker Verification by Neural Vocoders.Haibin Wu, Po-Chun Hsu, Ji Gao, Shanshan Zhang, Shen Huang, Jian Kang, Zhiyong Wu, Helen Meng, Hung-Yi Lee
2022ICASSPNeural Architecture Search for Speech Emotion Recognition.Xixin Wu, Shoukang Hu, Zhiyong Wu, Xunying Liu, Helen Meng
2022ICASSPPartially Fake Audio Detection by Self-Attention-Based Fake Span Discovery.Haibin Wu, Heng-Cheng Kuo, Naijun Zheng, Kuo-Hsuan Hung, Hung-Yi Lee, Yu Tsao, Hsin-Min Wang, Helen Meng
2022ICASSPCharacterizing the Adversarial Vulnerability of Speech self-Supervised Learning.Haibin Wu, Bo Zheng, Xu Li, Xixin Wu, Hung-Yi Lee, Helen Meng
2022ICASSPMixed Precision DNN Quantization for Overlapped Speech Separation and Recognition.Junhao Xu, Jianwei Yu, Xunying Liu, Helen Meng
2022ICASSPDisentangling Content and Fine-Grained Prosody Information Via Hybrid ASR Bottleneck Features for Voice Conversion.Xintao Zhao, Feng Liu, Changhe Song, Zhiyong Wu, Shiyin Kang, Deyi Tuo, Helen Meng
2022ICASSPThe CUHK-Tencent Speaker Diarization System for the ICASSP 2022 Multi-Channel Multi-Party Meeting Transcription Challenge.Naijun Zheng, Na Li, Xixin Wu, Lingwei Meng, Jiawen Kang, Haibin Wu, Chao Weng, Dan Su, Helen Meng
2022ICASSPMulti-Channel Speaker Diarization Using Spatial Features for Meetings.Naijun Zheng, Na Li, Jianwei Yu, Chao Weng, Dan Su, Xunying Liu, Helen Meng
2022InterspeechSpeech Enhancement with Fullband-Subband Cross-Attention Network.Jun Chen, Wei Rao, Zilin Wang, Zhiyong Wu, Yannan Wang, Tao Yu, Shidong Shang, Helen Meng
2022InterspeechImproving Mandarin Prosodic Structure Prediction with Multi-level Contextual Information.Jie Chen, Changhe Song, Deyi Tuo, Xixin Wu, Shiyin Kang, Zhiyong Wu, Helen Meng
2022InterspeechTwo-pass Decoding and Cross-adaptation Based System Combination of End-to-end Conformer and Hybrid TDNN ASR Systems.Mingyu Cui, Jiajun Deng, Shoukang Hu, Xurong Xie, Tianzi Wang, Shujie Hu, Mengzhe Geng, Boyang Xue, Xunying Liu, Helen Meng
2022InterspeechConfidence Score Based Conformer Speaker Adaptation for Speech Recognition.Jiajun Deng, Xurong Xie, Tianzi Wang, Mingyu Cui, Boyang Xue, Zengrui Jin, Mengzhe Geng, Guinan Li, Xunying Liu, Helen Meng
2022InterspeechA Multi-Scale Time-Frequency Spectrogram Discriminator for GAN-based Non-Autoregressive TTS.Haohan Guo, Hui Lu, Xixin Wu, Helen Meng
2022InterspeechA Multi-Stage Multi-Codebook VQ-VAE Approach to High-Performance Neural TTS.Haohan Guo, Feng-Long Xie, Frank K. Soong, Xixin Wu, Helen Meng
2022InterspeechTowards Multi-Scale Speaking Style Modelling with Hierarchical Context Information for Mandarin Speech Synthesis.Shun Lei, Yixuan Zhou, Liyang Chen, Jiankun Hu, Zhiyong Wu, Shiyin Kang, Helen Meng
2022InterspeechTowards Cross-speaker Reading Style Transfer on Audiobook Dataset.Xiang Li, Changhe Song, Xianhao Wei, Zhiyong Wu, Jia Jia, Helen Meng
2022InterspeechContext-aware Multimodal Fusion for Emotion Recognition.Jinchao Li, Shuai Wang, Yang Chao, Xunying Liu, Helen Meng
2022InterspeechCALM: Constrastive Cross-modal Speaking Style Modeling for Expressive Text-to-Speech Synthesis.Yi Meng, Xiang Li, Zhiyong Wu, Tingtian Li, Zixun Sun, Xinyu Xiao, Chi Sun, Hui Zhan, Helen Meng
2022InterspeechConformer Based Elderly Speech Recognition System for Alzheimer's Disease Detection.Tianzi Wang, Jiajun Deng, Mengzhe Geng, Zi Ye, Shoukang Hu, Yi Wang, Mingyu Cui, Zengrui Jin, Xunying Liu, Helen Meng
2022InterspeechExploring linguistic feature and model combination for speech recognition based automatic AD detection.Yi Wang, Tianzi Wang, Zi Ye, Lingwei Meng, Shoukang Hu, Xixin Wu, Xunying Liu, Helen Meng
2022InterspeechSpoofing-Aware Speaker Verification by Multi-Level Fusion.Haibin Wu, Lingwei Meng, Jiawen Kang, Jinchao Li, Xu Li, Xixin Wu, Hung-yi Lee, Helen Meng
2022InterspeechTowards Green ASR: Lossless 4-bit Quantization of a Hybrid TDNN System on the 300-hr Swithboard Corpus.Junhao Xu, Shoukang Hu, Xunying Liu, Helen Meng
2022InterspeechSpeech Representation Disentanglement with Adversarial Mutual Information Learning for One-shot Voice Conversion.Sicheng Yang, Methawee Tantrawenith, Haolin Zhuang, Zhiyong Wu, Aolan Sun, Jianzong Wang, Ning Cheng, Huaizhen Tang, Xintao Zhao, Jie Wang, Helen Meng
2022InterspeechMFA-Conformer: Multi-scale Feature Aggregation Conformer for Automatic Speaker Verification.Yang Zhang, Zhiqiang Lv, Haibin Wu, Shanshan Zhang, Pengfei Hu, Zhiyong Wu, Hung-yi Lee, Helen Meng
2022InterspeechTowards Improving the Expressiveness of Singing Voice Synthesis with BERT Derived Semantic Information.Shaohuan Zhou, Shun Lei, Weiya You, Deyi Tuo, Yuren You, Zhiyong Wu, Shiyin Kang, Helen Meng
2022InterspeechEnhancing Word-Level Semantic Representation via Dependency Structure for Expressive Text-to-Speech Synthesis.Yixuan Zhou, Changhe Song, Jingbei Li, Zhiyong Wu, Yanyao Bian, Dan Su, Helen Meng
2022InterspeechContent-Dependent Fine-Grained Speaker Embedding for Zero-Shot Speaker Adaptation in Text-to-Speech Synthesis.Yixuan Zhou, Changhe Song, Xiang Li, Luwen Zhang, Zhiyong Wu, Yanyao Bian, Dan Su, Helen Meng
2022NAACLPartner Personas Generation for Dialogue Response Generation.Hongyuan Lu, Wai Lam, Hong Cheng, Helen Meng
2022WWWUser Satisfaction Estimation with Sequential Dialogue Act Modeling in Goal-oriented Conversational Systems.Yang Deng, Wenxuan Zhang, Wai Lam, Hong Cheng, Helen Meng
2022SIGdialToward Self-Learning End-to-End Task-oriented Dialog Systems.Xiaoying Zhang, Baolin Peng, Jianfeng Gao, Helen Meng
2021ASRUDiffSVC: A Diffusion Probabilistic Model for Singing Voice Conversion.Songxiang Liu, Yuewen Cao, Dan Su, Helen Meng
2021ASRUReconstructing Dual Learning for Neural Voice Conversion Using Relatively Few Samples.Aolan Sun, Jianzong Wang, Ning Cheng, Methawee Tantrawenith, Zhiyong Wu, Helen Meng, Edward Xiao, Jing Xiao
2021ICASSPEmotion Controllable Speech Synthesis Using Emotion-Unlabeled Dataset with the Assistance of Cross-Domain Speech Emotion Recognition.Xiong Cai, Dongyang Dai, Zhiyong Wu, Xiang Li, Jingbei Li, Helen Meng
2021ICASSPNeural Architecture Search for LF-MMI Trained Time Delay Neural Networks.Shoukang Hu, Xurong Xie, Shansong Liu, Mingyu Cui, Mengzhe Geng, Xunying Liu, Helen Meng
2021ICASSPReplay and Synthetic Speech Detection with Res2Net Architecture.Xu Li, Na Li, Chao Weng, Xunying Liu, Dan Su, Dong Yu, Helen Meng
2021ICASSPA Comparative Study of Acoustic and Linguistic Features Classification for Alzheimer's Disease Detection.Jinchao Li, Jianwei Yu, Zi Ye, Simon Wong, Man-Wai Mak, Brian Mak, Xunying Liu, Helen Meng
2021ICASSPFcl-Taco2: Towards Fast, Controllable and Lightweight Text-to-Speech Synthesis.Disong Wang, Liqun Deng, Yang Zhang, Nianzu Zheng, Yu Ting Yeung, Xiao Chen, Xunying Liu, Helen Meng
2021ICASSPThe Huya Multi-Speaker and Multi-Style Speech Synthesis System for M2voc Challenge 2020.Jie Wang, Yuren You, Feng Liu, Deyi Tuo, Shiyin Kang, Zhiyong Wu, Helen Meng
2021ICASSPAdversarial Defense for Automatic Speaker Verification by Cascaded Self-Supervised Learning Models.Haibin Wu, Xu Li, Andy T. Liu, Zhiyong Wu, Helen Meng, Hung-yi Lee
2021ICASSPBayesian Transformer Language Models for Speech Recognition.Boyang Xue, Jianwei Yu, Junhao Xu, Shansong Liu, Shoukang Hu, Zi Ye, Mengzhe Geng, Xunying Liu, Helen Meng
2021ICASSPMixed Precision Quantization of Transformer Language Models for Speech Recognition.Junhao Xu, Shoukang Hu, Jianwei Yu, Xunying Liu, Helen Meng
2021ICASSPDevelopment of the Cuhk Elderly Speech Recognition System for Neurocognitive Disorder Detection Using the Dementiabank Corpus.Zi Ye, Shoukang Hu, Jinchao Li, Xurong Xie, Mengzhe Geng, Jianwei Yu, Junhao Xu, Boyang Xue, Shansong Liu, Xunying Liu, Helen Meng
2021ICASSPA Joint Training Framework of Multi-Look Separator and Speaker Embedding Extractor for Overlapped Speech.Naijun Zheng, Na Li, Bo Wu, Meng Yu, Jianwei Yu, Chao Weng, Dan Su, Xunying Liu, Helen Meng
2021InterspeechBayesian Parametric and Architectural Domain Adaptation of LF-MMI Trained TDNNs for Elderly and Dysarthric Speech Recognition.Jiajun Deng, Fabian Ritter Gutierrez, Shoukang Hu, Mengzhe Geng, Xurong Xie, Zi Ye, Shansong Liu, Jianwei Yu, Xunying Liu, Helen Meng
2021InterspeechSpectro-Temporal Deep Features for Disordered Speech Assessment and Recognition.Mengzhe Geng, Shansong Liu, Jianwei Yu, Xurong Xie, Shoukang Hu, Zi Ye, Zengrui Jin, Xunying Liu, Helen Meng
2021InterspeechAdversarial Data Augmentation for Disordered Speech Recognition.Zengrui Jin, Mengzhe Geng, Xurong Xie, Jianwei Yu, Shansong Liu, Xunying Liu, Helen Meng
2021InterspeechTowards Multi-Scale Style Control for Expressive Speech Synthesis.Xiang Li, Changhe Song, Jingbei Li, Zhiyong Wu, Jia Jia, Helen Meng
2021InterspeechChannel-Wise Gated Res2Net: Towards Robust Detection of Synthetic Speech Attacks.Xu Li, Xixin Wu, Hui Lu, Xunying Liu, Helen Meng
2021InterspeechVAENAR-TTS: Variational Auto-Encoder Based Non-AutoRegressive Text-to-Speech Synthesis.Hui Lu, Zhiyong Wu, Xixin Wu, Xu Li, Shiyin Kang, Xunying Liu, Helen Meng
2021InterspeechVQMIVC: Vector Quantization and Mutual Information-Based Unsupervised Speech Representation Disentanglement for One-Shot Voice Conversion.Disong Wang, Liqun Deng, Yu Ting Yeung, Xiao Chen, Xunying Liu, Helen Meng
2021InterspeechUnsupervised Domain Adaptation for Dysarthric Speech Detection via Domain Adversarial Training and Mutual Information Minimization.Disong Wang, Liqun Deng, Yu Ting Yeung, Xiao Chen, Xunying Liu, Helen Meng
2021InterspeechLearning Explicit Prosody Models and Deep Speaker Embeddings for Atypical Voice Conversion.Disong Wang, Songxiang Liu, Lifa Sun, Xixin Wu, Xunying Liu, Helen Meng
2021InterspeechAdversarially Learning Disentangled Speech Representations for Robust Multi-Factor Voice Conversion.Jie Wang, Jingbei Li, Xintao Zhao, Zhiyong Wu, Shiyin Kang, Helen Meng
2021InterspeechTransformer Based End-to-End Mispronunciation Detection and Diagnosis.Minglin Wu, Kun Li, Wai-Kim Leung, Helen Meng
2020ICASSPCode-Switched Speech Synthesis Using Bilingual Phonetic Posteriorgram with Only Monolingual Corpora.Yuewen Cao, Songxiang Liu, Xixin Wu, Shiyin Kang, Peng Liu, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng
2020ICASSPEnd-To-End Accent Conversion Without Using Native Utterances.Songxiang Liu, Disong Wang, Yuewen Cao, Lifa Sun, Xixin Wu, Shiyin Kang, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng
2020ICASSPAdversarial Attacks on GMM I-Vector Based Speaker Verification Systems.Xu Li, Jinghua Zhong, Xixin Wu, Jianwei Yu, Xunying Liu, Helen Meng
2020ICASSPEnd-To-End Voice Conversion Via Cross-Modal Knowledge Distillation for Dysarthric Speech Reconstruction.Disong Wang, Jianwei Yu, Xixin Wu, Songxiang Liu, Lifa Sun, Xunying Liu, Helen Meng
2020ICASSPDefense Against Adversarial Attacks on Spoofing Countermeasures of ASV.Haibin Wu, Songxiang Liu, Helen Meng, Hung-yi Lee
2020ICASSPLow-bit Quantization of Recurrent Neural Network Language Models Using Alternating Direction Methods of Multipliers.Junhao Xu, Xie Chen, Shoukang Hu, Jianwei Yu, Xunying Liu, Helen Meng
2020ICASSPAudio-Visual Recognition of Overlapped Speech for the LRS2 Dataset.Jianwei Yu, Shi-Xiong Zhang, Jian Wu, Shahram Ghorbani, Bo Wu, Shiyin Kang, Shansong Liu, Xunying Liu, Helen Meng, Dong Yu
2020InterspeechInvestigation of Data Augmentation Techniques for Disordered Speech Recognition.Mengzhe Geng, Xurong Xie, Shansong Liu, Jianwei Yu, Shoukang Hu, Xunying Liu, Helen Meng
2020InterspeechEnhancing Monotonicity for Robust Autoregressive Transformer TTS.Xiangyu Liang, Zhiyong Wu, Runnan Li, Yanqing Liu, Sheng Zhao, Helen Meng
2020InterspeechInvestigating Robustness of Adversarial Samples Detection for Automatic Speaker Verification.Xu Li, Na Li, Jinghua Zhong, Xixin Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng
2020InterspeechGroup Gated Fusion on Attention-Based Bidirectional Alignment for Multimodal Emotion Recognition.Pengfei Liu, Kun Li, Helen Meng
2020InterspeechTransferring Source Style in Non-Parallel Voice Conversion.Songxiang Liu, Yuewen Cao, Shiyin Kang, Na Hu, Xunying Liu, Dan Su, Dong Yu, Helen Meng
2020InterspeechExploiting Cross-Domain Visual Feature Generation for Disordered Speech Recognition.Shansong Liu, Xurong Xie, Jianwei Yu, Shoukang Hu, Mengzhe Geng, Rongfeng Su, Shi-Xiong Zhang, Xunying Liu, Helen Meng
2020InterspeechSpecSwap: A Simple Data Augmentation Method for End-to-End Speech Recognition.Xingcheng Song, Zhiyong Wu, Yiheng Huang, Dan Su, Helen Meng
2020InterspeechSpeech-XLNet: Unsupervised Acoustic Model Pretraining for Self-Attention Networks.Xingchen Song, Guangsen Wang, Yiheng Huang, Zhiyong Wu, Dan Su, Helen Meng
2020InterspeechAudio-Visual Multi-Channel Recognition of Overlapped Speech.Jianwei Yu, Bo Wu, Rongzhi Gu, Shi-Xiong Zhang, Lianwu Chen, Yong Xu, Meng Yu, Dan Su, Dong Yu, Xunying Liu, Helen Meng
2020InterspeechRe-Weighted Interval Loss for Handling Data Imbalance Problem of End-to-End Keyword Spotting.Kun Zhang, Zhiyong Wu, Daode Yuan, Jian Luan, Jia Jia, Helen Meng, Binheng Song
2020InterspeechSpeaker-Aware Linear Discriminant Analysis in Speaker Verification.Naijun Zheng, Xixin Wu, Jinghua Zhong, Xunying Liu, Helen Meng
2019ASRUAdversarial Attacks on Spoofing Countermeasures of Automatic Speaker Verification.Songxiang Liu, Haibin Wu, Hung-yi Lee, Helen Meng
2019ICASSPEnd-to-end Code-switched TTS with Mix of Monolingual Recordings.Yuewen Cao, Xixin Wu, Songxiang Liu, Jianwei Yu, Xu Li, Zhiyong Wu, Xunying Liu, Helen Meng
2019ICASSPLearning Discriminative Features from Spectrograms Using Center Loss for Speech Emotion Recognition.Dongyang Dai, Zhiyong Wu, Runnan Li, Xixin Wu, Jia Jia, Helen Meng
2019ICASSPBayesian and Gaussian Process Neural Networks for Large Vocabulary Continuous Speech Recognition.Shoukang Hu, Max W. Y. Lam, Xurong Xie, Shansong Liu, Jianwei Yu, Xixin Wu, Xunying Liu, Helen Meng
2019ICASSPGaussian Process Lstm Recurrent Neural Network Language Models for Speech Recognition.Max W. Y. Lam, Xie Chen, Shoukang Hu, Jianwei Yu, Xunying Liu, Helen Meng
2019ICASSPCNN-RNN-CTC Based End-to-end Mispronunciation Detection and Diagnosis.Wai-Kim Leung, Xunying Liu, Helen Meng
2019ICASSPDilated Residual Network with Multi-head Self-attention for Speech Emotion Recognition.Runnan Li, Zhiyong Wu, Jia Jia, Sheng Zhao, Helen Meng
2019ICASSPA Compact Framework for Voice Conversion Using Wavenet Conditioned on Phonetic Posteriorgrams.Hui Lu, Zhiyong Wu, Runnan Li, Shiyin Kang, Jia Jia, Helen Meng
2019ICASSPQuasi-fully Convolutional Neural Network with Variational Inference for Speech Synthesis.Mu Wang, Xixin Wu, Zhiyong Wu, Shiyin Kang, Deyi Tuo, Guangzhi Li, Dan Su, Dong Yu, Helen Meng
2019ICASSPSpeech Emotion Recognition Using Capsule Networks.Xixin Wu, Songxiang Liu, Yuewen Cao, Xu Li, Jianwei Yu, Dongyang Dai, Xi Ma, Shoukang Hu, Zhiyong Wu, Xunying Liu, Helen Meng
2019ICASSPRecurrent Neural Network Language Model Training Using Natural Gradient.Jianwei Yu, Max W. Y. Lam, Xie Chen, Shoukang Hu, Songxiang Liu, Xixin Wu, Xunying Liu, Helen Meng
2019IJCAITowards Discriminative Representation Learning for Speech Emotion Recognition.Runnan Li, Zhiyong Wu, Jia Jia, Yaohua Bu, Sheng Zhao, Helen Meng
2019InterspeechDisambiguation of Chinese Polyphones in an End-to-End Framework with Semantic Features Extracted by Pre-Trained BERT.Dongyang Dai, Zhiyong Wu, Shiyin Kang, Xixin Wu, Jia Jia, Dan Su, Dong Yu, Helen Meng
2019InterspeechThe CUHK Dysarthric Speech Recognition Systems for English and Cantonese.Shoukang Hu, Shansong Liu, Heng Fai Chang, Mengzhe Geng, Jiani Chen, Lau Wing Chung, To Ka Hei, Jianwei Yu, Ka Ho Wong, Xunying Liu, Helen Meng
2019InterspeechLF-MMI Training of Bayesian and Gaussian Process Time Delay Neural Networks for Speech Recognition.Shoukang Hu, Xurong Xie, Shansong Liu, Max W. Y. Lam, Jianwei Yu, Xixin Wu, Xunying Liu, Helen Meng
2019InterspeechExtract, Adapt and Recognize: An End-to-End Neural Network for Corrupted Monaural Speech Recognition.Max W. Y. Lam, Jun Wang, Xunying Liu, Helen Meng, Dan Su, Dong Yu
2019InterspeechJointly Trained Conversion Model and WaveNet Vocoder for Non-Parallel Voice Conversion Using Mel-Spectrograms and Phonetic Posteriorgrams.Songxiang Liu, Yuewen Cao, Xixin Wu, Lifa Sun, Xunying Liu, Helen Meng
2019InterspeechOn the Use of Pitch Features for Disordered Speech Recognition.Shansong Liu, Shoukang Hu, Xunying Liu, Helen Meng
2019InterspeechExploiting Visual Features Using Bayesian Gated Neural Networks for Disordered Speech Recognition.Shansong Liu, Shoukang Hu, Yi Wang, Jianwei Yu, Rongfeng Su, Xunying Liu, Helen Meng
2019InterspeechKnowledge-Based Linguistic Encoding for End-to-End Mandarin Text-to-Speech Synthesis.Jingbei Li, Zhiyong Wu, Runnan Li, Pengpeng Zhi, Song Yang, Helen Meng
2019InterspeechOne-Shot Voice Conversion with Global Speaker Embeddings.Hui Lu, Zhiyong Wu, Dongyang Dai, Runnan Li, Shiyin Kang, Jia Jia, Helen Meng
2019InterspeechUnsupervised Methods for Audio Classification from Lecture Discussion Recordings.Hang Su, Borislav Dzodzo, Xixin Wu, Xunying Liu, Helen Meng
2019InterspeechComparative Study of Parametric and Representation Uncertainty Modeling for Recurrent Neural Network Language Models.Jianwei Yu, Max W. Y. Lam, Shoukang Hu, Xixin Wu, Xu Li, Yuewen Cao, Xunying Liu, Helen Meng
2019WWWSemi-Supervised Graph Classification: A Hierarchical Graph Perspective.Jia Li, Yu Rong, Hong Cheng, Helen Meng, Wen-bing Huang, Junzhou Huang
2018ICASSPLimited-Memory BFGS Optimization of Recurrent Neural Network Language Models for Speech Recognition.Xunying Liu, Shansong Liu, Jinze Sha, Jianwei Yu, Zhiyuan Xu, Xie Chen, Helen Meng
2018ICASSPEmphatic Speech Generation with Conditioned Input Layer and Bidirectional LSTMS for Expressive Speech Synthesis.Runnan Li, Zhiyong Wu, Yuchen Huang, Jia Jia, Helen Meng, Lianhong Cai
2018ICASSPUnsupervised Discovery of an Extended Phoneme Set in L2 English Speech for Mispronunciation Detection and Diagnosis.Shaoguang Mao, Xu Li, Kun Li, Zhiyong Wu, Xunying Liu, Helen Meng
2018ICASSPApplying Multitask Learning to Acoustic-Phonemic Model for Mispronunciation Detection and Diagnosis in L2 English Speech.Shaoguang Mao, Zhiyong Wu, Runnan Li, Xu Li, Helen Meng, Lianhong Cai
2018ICASSPFeature Based Adaptation for Speaking Style Synthesis.Xixin Wu, Lifa Sun, Shiyin Kang, Songxiang Liu, Zhiyong Wu, Xunying Liu, Helen Meng
2018InterspeechGaussian Process Neural Networks for Speech Recognition.Max W. Y. Lam, Shoukang Hu, Xurong Xie, Shansong Liu, Jianwei Yu, Rongfeng Su, Xunying Liu, Helen Meng
2018InterspeechUnsupervised Discovery of Non-native Phonetic Patterns in L2 English Speech for Mispronunciation Detection and Diagnosis.Xu Li, Shaoguang Mao, Xixin Wu, Kun Li, Xunying Liu, Helen Meng
2018InterspeechVoice Conversion Across Arbitrary Speakers Based on a Single Target-Speaker Utterance.Songxiang Liu, Jinghua Zhong, Lifa Sun, Xixin Wu, Xunying Liu, Helen Meng
2018InterspeechEmotion Recognition from Variable-Length Speech Segments Using Deep Learning on Spectrograms.Xi Ma, Zhiyong Wu, Jia Jia, Mingxing Xu, Helen Meng, Lianhong Cai
2018InterspeechSpeech and Language Processing for Learning and Wellbeing.Helen Meng
2018InterspeechRapid Style Adaptation Using Residual Error Embedding for Expressive Speech Synthesis.Xixin Wu, Yuewen Cao, Mu Wang, Songxiang Liu, Shiyin Kang, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng
2018InterspeechDetection of Glottal Closure Instants from Speech Signals: A Convolutional Neural Network Based Method.Shuai Yang, Zhiyong Wu, Binbin Shen, Helen Meng
2018InterspeechDevelopment of the CUHK Dysarthric Speech Recognition System for the UA Speech Corpus.Jianwei Yu, Xurong Xie, Shansong Liu, Shoukang Hu, Max W. Y. Lam, Xixin Wu, Ka Ho Wong, Xunying Liu, Helen Meng
2018InterspeechSiamese Recurrent Auto-Encoder Representation for Query-by-Example Spoken Term Detection.Ziwei Zhu, Zhiyong Wu, Runnan Li, Helen Meng, Lianhong Cai
2018KDDTATC: Predicting Alzheimer's Disease with Actigraphy Data.Jia Li, Yu Rong, Helen Meng, Zhihui Lu, Timothy C. Y. Kwok, Hong Cheng
2017InterspeechMulti-Task Learning for Prosodic Structure Generation Using BLSTM RNN with Structured Output Layer.Yuchen Huang, Zhiyong Wu, Runnan Li, Helen Meng, Lianhong Cai
2017InterspeechSpectro-Temporal Modelling with Time-Frequency LSTM and Structured Output Layer for Voice Conversion.Runnan Li, Zhiyong Wu, Yishuang Ning, Lifa Sun, Helen Meng, Lianhong Cai
2017InterspeechSpeech Emotion Recognition with Emotion-Pair Based Framework Considering Emotion Distribution Information in Dimensional Emotion Space.Xi Ma, Zhiyong Wu, Jia Jia, Mingxing Xu, Helen Meng, Lianhong Cai
2017InterspeechDNN i-Vector Speaker Verification with Short, Text-Constrained Test Utterances.Jinghua Zhong, Wenping Hu, Frank K. Soong, Helen Meng
2016ICASSPLow level descriptors based DBLSTM bottleneck feature for speech driven talking avatar.Xinyu Lan, Xu Li, Yishuang Ning, Zhiyong Wu, Helen Meng, Jia Jia, Lianhong Cai
2016ICASSPQuestion detection from acoustic features using recurrent neural network with gated recurrent unit.Yaodong Tang, Yuchen Huang, Zhiyong Wu, Helen Meng, Mingxing Xu, Lianhong Cai
2016ICASSPLearning cross-lingual information with multilingual BLSTM for speech synthesis of low-resource languages.Quanjie Yu, Peng Liu, Zhiyong Wu, Shiyin Kang, Helen Meng, Lianhong Cai
2015ICASSPAA spectral space warping approach to cross-lingual voice transformation in HMM-based TTS.Hao Wang, Frank K. Soong, Helen Meng
2015IJCAIModelling High-Dimensional Sequences with LSTM-RTRBM: Application to Polyphonic Music Generation.Qi Lyu, Zhiyong Wu, Jun Zhu, Helen Meng
2014ICASSPPhonological modeling of mispronunciation gradations in L2 English speech of L1 Chinese learners.Hao Wang, Xiaojun Qian, Helen Meng
2014ICASSPLearning dynamic features with neural networks for phoneme recognition.Xin Zheng, Zhiyong Wu, Helen Meng, Lianhong Cai
2014ICASSPContrastive auto-encoder for phoneme recognition.Xin Zheng, Zhiyong Wu, Helen Meng, Lianhong Cai
2013ICASSPMulti-distribution deep belief network for speech synthesis.Shiyin Kang, Xiaojun Qian, Helen Meng
2013InterspeechLexical stress detection for L2 English speech using deep belief networks.Kun Li, Xiaojun Qian, Shiyin Kang, Helen Meng
2009InterspeechStudying L2 suprasegmental features in asian Englishes: a position paper.Helen Meng, Chiu-yu Tseng, Mariko Kondo, Alissa M. Harrison, Tanya Visceglia
2009PACLICDeveloping Speech Recognition and Synthesis Technologies to Support Computer-Aided Pronunciation Training for Chinese Learners of English.Helen Meng
2007NAACLCombined Use of Speaker- and Tone-Normalized Pitch Reset with Pause Duration for Automatic Story Segmentation in Mandarin Broadcast News.Lei Xie, Chuan Liu, Helen Meng
2006ICASSPA Comparative Study of Discriminative Methods for Reranking LVCSR N-Best Hypotheses in Domain Adaptation and Generalization.Zhengyu Zhou, Jianfeng Gao, Frank K. Soong, Helen Meng
2005NAACLThe Use of Metadata, Web-derived Answer Patterns and Passage Context to Improve Reading Comprehension Performance.Yongping Du, Helen Meng, Xuanjing Huang, Lide Wu
2004ICASSPEnglish-Chinese bilingual text-independent speaker verification.Bin Ma, Helen Meng
2004ICASSPBilingual Chinese/English voice browsing based on a VoiceXML platform.Helen Meng, Yuk-Chi Li, Tien Ying Fung, Kon Fan Low, Ka-Fai Chow, Tin Hang Lo, Man Cheuk Ho, P. C. Ching