| 2026 | AAAI | DualSpeechLM: Towards Unified Speech Understanding and Generation via Dual Speech Token Modeling with Large Language Models. | Yuanyuan Wang, Dongchao Yang, Yiwen Shao, Hangting Chen, Jiankun Zhao, Zhiyong Wu, Helen Meng, Xixin Wu |
| 2025 | ICASSP | Disentangling Speakers in Multi-Talker Speech Recognition with Speaker-Aware CTC. | Jiawen Kang, Lingwei Meng, Mingyu Cui, Yuejiao Wang, Xixin Wu, Xunying Liu, Helen Meng |
| 2025 | ICASSP | Speaking from Coarse to Fine: Improving Neural Codec Language Model via Multi-Scale Speech Coding and Generation. | Haohan Guo, Fenglong Xie, Dongchao Yang, Xixin Wu, Helen Meng |
| 2025 | ICASSP | Spectral-Aware Low-Rank Adaptation for Speaker Verification. | Zhe Li, Man-Wai Mak, Mert Pilanci, Hung-yi Lee, Helen Meng |
| 2025 | ICASSP | Large Language Model Can Transcribe Speech in Multi-Talker Scenarios with Versatile Instructions. | Lingwei Meng, Shujie Hu, Jiawen Kang, Zhaoqing Li, Yuejiao Wang, Wenxuan Wu, Xixin Wu, Xunying Liu, Helen Meng |
| 2025 | ICASSP | Integrating Potential Pronunciations for Enhanced Mispronunciation Detection and Diagnosis Ability in LLMs. | Minglin Wu, Jing Xu, Xueyuan Chen, Helen Meng |
| 2025 | Interspeech | On the Within-class Variation Issue in Alzheimer's Disease Detection. | Jiawen Kang, Dongrui Han, Lingwei Meng, Jingyan Zhou, Jinchao Li, Xixin Wu, Helen Meng |
| 2025 | Interspeech | Disentangling Speaker and Content in Pre-trained Speech Models with Latent Diffusion for Robust Speaker Verification. | Zhe Li, Man-Wai Mak, Jen-Tzung Chien, Mert Pilanci, Zezhong Jin, Helen Meng |
| 2025 | Interspeech | DiffDSR: Dysarthric Speech Reconstruction Using Latent Diffusion Model. | Xueyuan Chen, Dongchao Yang, Wenxuan Wu, Minglin Wu, Jing Xu, Xixin Wu, Zhiyong Wu, Helen Meng |
| 2025 | Interspeech | On-the-fly Routing for Zero-shot MoE Speaker Adaptation of Speech Foundation Models for Dysarthric Speech Recognition. | Shujie Hu, Xurong Xie, Mengzhe Geng, Jiajun Deng, Huimeng Wang, Guinan Li, Chengxi Deng, Tianzi Wang, Mingyu Cui, Helen Meng, Xunying Liu |
| 2025 | Interspeech | Optimizing Pause Context in Fine-Tuning Pre-trained Large Language Models for Dementia Detection. | Xiaoquan Ke, Man-Wai Mak, Helen Meng |
| 2025 | Interspeech | Incorporating Linguistic Constraints from External Knowledge Source for Audio-Visual Target Speech Extraction. | Wenxuan Wu, Shuai Wang, Xixin Wu, Helen Meng, Haizhou Li |
| 2025 | Interspeech | Defending Unauthorized Voice Cloning with Watermark-Aware Codecs. | Jiankun Zhao, Lingwei Meng, Chengxi Deng, Helen Meng, Xixin Wu |
| 2024 | AAAI | SimCalib: Graph Neural Network Calibration Based on Similarity between Nodes. | Boshi Tang, Zhiyong Wu, Xixin Wu, Qiaochu Huang, Jun Chen, Shun Lei, Helen Meng |
| 2024 | ACL | COKE: A Cognitive Knowledge Graph for Machine Theory of Mind. | Jincenzi Wu, Zhuang Chen, Jiawen Deng, Sahand Sabour, Helen Meng, Minlie Huang |
| 2024 | ACL | Self-Alignment for Factuality: Mitigating Hallucinations in LLMs via Self-Evaluation. | Xiaoying Zhang, Baolin Peng, Ye Tian, Jingyan Zhou, Lifeng Jin, Linfeng Song, Haitao Mi, Helen Meng |
| 2024 | CHI | Designing Scaffolding Strategies for Conversational Agents in Dialog Task of Neurocognitive Disorders Screening. | Jiaxiong Hu, Junze Li, Yuhang Zeng, Dongjie Yang, Danxuan Liang, Helen Meng, Xiaojuan Ma |
| 2024 | CIKM | Natural Language-Assisted Multi-modal Medication Recommendation. | Jie Tan, Yu Rong, Kangfei Zhao, Tian Bian, Tingyang Xu, Junzhou Huang, Hong Cheng, Helen Meng |
| 2024 | EMNLP | Adaptive Query Rewriting: Aligning Rewriters through Marginal Probability of Conversational Answers. | Tianhua Zhang, Kun Li, Hongyin Luo, Xixin Wu, James R. Glass, Helen Meng |
| 2024 | ICASSP | Cross-Speaker Encoding Network for Multi-Talker Speech Recognition. | Jiawen Kang, Lingwei Meng, Mingyu Cui, Haohan Guo, Xixin Wu, Xunying Liu, Helen Meng |
| 2024 | ICASSP | Exploiting Audio-Visual Features with Pretrained AV-HuBERT for Multi-Modal Dysarthric Speech Reconstruction. | Xueyuan Chen, Yuejiao Wang, Xixin Wu, Disong Wang, Zhiyong Wu, Xunying Liu, Helen Meng |
| 2024 | ICASSP | Stylespeech: Self-Supervised Style Enhancing with VQ-VAE-Based Pre-Training for Expressive Audiobook Speech Synthesis. | Xueyuan Chen, Xi Wang, Shaofei Zhang, Lei He, Zhiyong Wu, Xixin Wu, Helen Meng |
| 2024 | ICASSP | Enhancing Expressiveness in Dance Generation Via Integrating Frequency and Music Style Information. | Qiaochu Huang, Xu He, Boshi Tang, Haolin Zhuang, Liyang Chen, Shuochen Gao, Zhiyong Wu, Haozhi Huang, Helen Meng |
| 2024 | ICASSP | Improving Language Model-Based Zero-Shot Text-to-Speech Synthesis with Multi-Scale Acoustic Prompts. | Shun Lei, Yixuan Zhou, Liyang Chen, Dan Luo, Zhiyong Wu, Xixin Wu, Shiyin Kang, Tao Jiang, Yahui Zhou, Yuxing Han, Helen Meng |
| 2024 | ICASSP | Multi-View Midivae: Fusing Track- and Bar-View Representations for Long Multi-Track Symbolic Music Generation. | Zhiwei Lin, Jun Chen, Boshi Tang, Binzhu Sha, Jing Yang, Yaolong Ju, Fan Fan, Shiyin Kang, Zhiyong Wu, Helen Meng |
| 2024 | ICASSP | Unifying One-Shot Voice Conversion and Cloning with Disentangled Speech Representations. | Hui Lu, Xixin Wu, Haohan Guo, Songxiang Liu, Zhiyong Wu, Helen Meng |
| 2024 | ICASSP | Neural Concatenative Singing Voice Conversion: Rethinking Concatenation-Based Approach for One-Shot Singing Voice Conversion. | Binzhu Sha, Xu Li, Zhiyong Wu, Ying Shan, Helen Meng |
| 2024 | ICASSP | SCNet: Sparse Compression Network for Music Source Separation. | Weinan Tong, Jiaxu Zhu, Jun Chen, Shiyin Kang, Tao Jiang, Yang Li, Zhiyong Wu, Helen Meng |
| 2024 | ICASSP | Consistent and Relevant: Rethink the Query Embedding in General Sound Separation. | Yuanyuan Wang, Hangting Chen, Dongchao Yang, Jianwei Yu, Chao Weng, Zhiyong Wu, Helen Meng |
| 2024 | ICASSP | UNIT-DSR: Dysarthric Speech Reconstruction System Using Speech Unit Normalization. | Yuejiao Wang, Xixin Wu, Disong Wang, Lingwei Meng, Helen Meng |
| 2024 | ICASSP | Conversational Co-Speech Gesture Generation via Modeling Dialog Intention, Emotion, and Context with Diffusion Models. | Haiwei Xue, Sicheng Yang, Zhensong Zhang, Zhiyong Wu, Minglei Li, Zonghong Dai, Helen Meng |
| 2024 | IJCNN | Target Speech Extraction with Pre-trained AV-HuBERT and Mask-And-Recover Strategy. | Wenxuan Wu, Xueyuan Chen, Xixin Wu, Haizhou Li, Helen Meng |
| 2024 | Interspeech | LoRA-MER: Low-Rank Adaptation of Pre-Trained Speech Models for Multimodal Emotion Recognition Using Mutual Information. | Yunrui Cai, Zhiyong Wu, Jia Jia, Helen Meng |
| 2024 | Interspeech | CoLM-DSR: Leveraging Neural Codec Language Modeling for Multi-Modal Dysarthric Speech Reconstruction. | Xueyuan Chen, Dongchao Yang, Dingdong Wang, Xixin Wu, Zhiyong Wu, Helen Meng |
| 2024 | Interspeech | Joint Speaker Features Learning for Audio-visual Multichannel Speech Separation and Recognition. | Guinan Li, Jiajun Deng, Youjun Chen, Mengzhe Geng, Shujie Hu, Zhe Li, Zengrui Jin, Tianzi Wang, Xurong Xie, Helen Meng, Xunying Liu |
| 2024 | Interspeech | Parameter-efficient Fine-tuning of Speaker-Aware Dynamic Prompts for Speaker Verification. | Zhe Li, Man-Wai Mak, Hung-yi Lee, Helen Meng |
| 2024 | Interspeech | Spontaneous Style Text-to-Speech Synthesis with Controllable Spontaneous Behaviors Based on Language Models. | Weiqin Li, Peiji Yang, Yicheng Zhong, Yixuan Zhou, Zhisheng Wang, Zhiyong Wu, Xixin Wu, Helen Meng |
| 2024 | Interspeech | Empowering Whisper as a Joint Multi-Talker and Target-Talker Speech Recognition System. | Lingwei Meng, Jiawen Kang, Yuejiao Wang, Zengrui Jin, Xixin Wu, Xunying Liu, Helen Meng |
| 2024 | Interspeech | Large Language Model-based FMRI Encoding of Language Functions for Subjects with Neurocognitive Disorder. | Yuejiao Wang, Xianmin Gong, Lingwei Meng, Xixin Wu, Helen Meng |
| 2024 | Interspeech | Towards Effective and Efficient Non-autoregressive Decoding Using Block-based Attention Mask. | Tianzi Wang, Xurong Xie, Zhaoqing Li, Shoukang Hu, Zengrui Jin, Jiajun Deng, Mingyu Cui, Shujie Hu, Mengzhe Geng, Guinan Li, Helen Meng, Xunying Liu |
| 2024 | Interspeech | Prompting Large Language Models with Mispronunciation Detection and Diagnosis Abilities. | Minglin Wu, Jing Xu, Xixin Wu, Helen Meng |
| 2024 | Interspeech | Seamless Language Expansion: Enhancing Multilingual Mastery in Self-Supervised Models. | Jing Xu, Minglin Wu, Xixin Wu, Helen Meng |
| 2024 | Interspeech | SimpleSpeech: Towards Simple and Efficient Text-to-Speech with Scalar Latent Transformer Diffusion Models. | Dongchao Yang, Dingdong Wang, Haohan Guo, Xueyuan Chen, Xixin Wu, Helen Meng |
| 2024 | NAACL | Natural Language Embedded Programs for Hybrid Language Symbolic Reasoning. | Tianhua Zhang, Jiaxin Ge, Hongyin Luo, Yung-Sung Chuang, Mingye Gao, Yuan Gong, Yoon Kim, Xixin Wu, Helen Meng, Jim Glass |
| 2024 | NAACL | Rethinking Machine Ethics - Can LLMs Perform Moral Reasoning through the Lens of Moral Theories? | Jingyan Zhou, Minda Hu, Junan Li, Xiaoying Zhang, Xixin Wu, Irwin King, Helen Meng |
| 2023 | EMNLP | Search Augmented Instruction Learning. | Hongyin Luo, Tianhua Zhang, Yung-Sung Chuang, Yuan Gong, Yoon Kim, Xixin Wu, Helen Meng, James R. Glass |
| 2023 | EMNLP | SGP-TOD: Building Task Bots Effortlessly via Schema-Guided LLM Prompting. | Xiaoying Zhang, Baolin Peng, Kun Li, Jingyan Zhou, Helen Meng |
| 2023 | ICASSP | Inter-Subnet: Speech Enhancement with Subband Interaction. | Jun Chen, Wei Rao, Zilin Wang, Jiuxin Lin, Zhiyong Wu, Yannan Wang, Shidong Shang, Helen Meng |
| 2023 | ICASSP | Exploring Self-Supervised Pre-Trained ASR Models for Dysarthric and Elderly Speech Recognition. | Shujie Hu, Xurong Xie, Zengrui Jin, Mengzhe Geng, Yi Wang, Mingyu Cui, Jiajun Deng, Xunying Liu, Helen Meng |
| 2023 | ICASSP | Context-Aware Coherent Speaking Style Prediction with Hierarchical Transformers for Audiobook Speech Synthesis. | Shun Lei, Yixuan Zhou, Liyang Chen, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2023 | ICASSP | Av-Sepformer: Cross-Attention Sepformer for Audio-Visual Target Speaker Extraction. | Jiuxin Lin, Xinyu Cai, Heinrich Dinkel, Jun Chen, Zhiyong Yan, Yongqing Wang, Junbo Zhang, Zhiyong Wu, Yujun Wang, Helen Meng |
| 2023 | ICASSP | Leveraging Pretrained Representations With Task-Related Keywords for Alzheimer's Disease Detection. | Jinchao Li, Kaitao Song, Junan Li, Bo Zheng, Dongsheng Li, Xixin Wu, Xunying Liu, Helen Meng |
| 2023 | ICASSP | A Hierarchical Regression Chain Framework for Affective Vocal Burst Recognition. | Jinchao Li, Xixin Wu, Kaitao Song, Dongsheng Li, Xunying Liu, Helen Meng |
| 2023 | ICASSP | A Sidecar Separator Can Convert A Single-Talker Speech Recognition System to A Multi-Talker One. | Lingwei Meng, Jiawen Kang, Mingyu Cui, Yuejiao Wang, Xixin Wu, Helen Meng |
| 2023 | ICASSP | Contrastive Learning with Dialogue Attributes for Neural Dialogue Generation. | Jie Tan, Hengyi Cai, Hongshen Chen, Hong Cheng, Helen Meng, Zhuoye Ding |
| 2023 | ICASSP | TFCnet: Time-Frequency Domain Corrector for Speech Separation. | Weinan Tong, Jiaxu Zhu, Jun Chen, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2023 | ICASSP | Exploiting Prompt Learning with Pre-Trained Language Models for Alzheimer's Disease Detection. | Yi Wang, Jiajun Deng, Tianzi Wang, Bo Zheng, Shoukang Hu, Xunying Liu, Helen Meng |
| 2023 | ICASSP | A Synthetic Corpus Generation Method for Neural Vocoder Training. | Zilin Wang, Peng Liu, Jun Chen, Sipan Li, Jinfeng Bai, Gang He, Zhiyong Wu, Helen Meng |
| 2023 | ICASSP | DASA: Difficulty-Aware Semantic Augmentation for Speaker Verification. | Yuanyuan Wang, Yang Zhang, Zhiyong Wu, Zhihan Yang, Tao Wei, Kun Zou, Helen Meng |
| 2023 | ICASSP | CB-Conformer: Contextual Biasing Conformer for Biased Word Recognition. | Yaoxun Xu, Baiji Liu, Qiaochu Huang, Xingchen Song, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2023 | ICASSP | Keyword-Specific Acoustic Model Pruning for Open-Vocabulary Keyword Spotting. | Yujie Yang, Kun Zhang, Zhiyong Wu, Helen Meng |
| 2023 | ICASSP | Enhancing the Vocal Range of Single-Speaker Singing Voice Synthesis with Melody-Unsupervised Pre-Training. | Shaohuan Zhou, Xu Li, Zhiyong Wu, Ying Shan, Helen Meng |
| 2023 | ICASSP | GTN-Bailando: Genre Consistent long-Term 3D Dance Generation Based on Pre-Trained Genre Token Network. | Haolin Zhuang, Shun Lei, Long Xiao, Weiqin Li, Liyang Chen, Sicheng Yang, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2023 | ICDE | Decision Support System for Chronic Diseases Based on Drug-Drug Interactions. | Tian Bian, Yuli Jiang, Jia Li, Tingyang Xu, Yu Rong, Yi Su, Timothy C. Y. Kwok, Helen Meng, Hong Cheng |
| 2023 | Interspeech | Diverse and Expressive Speech Prosody Prediction with Denoising Diffusion Probabilistic Model. | Xiang Li, Songxiang Liu, Max W. Y. Lam, Zhiyong Wu, Chao Weng, Helen Meng |
| 2023 | Interspeech | On-the-Fly Feature Based Rapid Speaker Adaptation for Dysarthric and Elderly Speech Recognition. | Mengzhe Geng, Xurong Xie, Rongfeng Su, Jianwei Yu, Zengrui Jin, Tianzi Wang, Shujie Hu, Zi Ye, Helen Meng, Xunying Liu |
| 2023 | Interspeech | Exploiting Cross-Domain And Cross-Lingual Ultrasound Tongue Imaging Features For Elderly And Dysarthric Speech Recognition. | Shujie Hu, Xurong Xie, Mengzhe Geng, Mingyu Cui, Jiajun Deng, Guinan Li, Tianzi Wang, Helen Meng, Xunying Liu |
| 2023 | Interspeech | Towards Spontaneous Style Modeling with Semi-supervised Pre-training for Conversational Text-to-Speech Synthesis. | Weiqin Li, Shun Lei, Qiaochu Huang, Yixuan Zhou, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2023 | Interspeech | PunCantonese: A Benchmark Corpus for Low-Resource Cantonese Punctuation Restoration from Speech Transcripts. | Yunxiang Li, Pengfei Liu, Xixin Wu, Helen Meng |
| 2023 | Interspeech | Unified Modeling of Multi-Talker Overlapped Speech Recognition and Diarization with a Sidecar Separator. | Lingwei Meng, Jiawen Kang, Mingyu Cui, Haibin Wu, Xixin Wu, Helen Meng |
| 2023 | Interspeech | Integrated and Enhanced Pipeline System to Support Spoken Language Analytics for Screening Neurocognitive Disorders. | Helen Meng, Brian Mak, Man-Wai Mak, Helene H. Fung, Xianmin Gong, Timothy C. Y. Kwok, Xunying Liu, Vincent C. T. Mok, Patrick C. M. Wong, Jean Woo, Xixin Wu, Ka Ho Wong, Sean Shensheng Xu, Naijun Zheng, Ranzo Huang, Jiawen Kang, Xiaoquan Ke, Junan Li, Jinchao Li, Yi Wang |
| 2023 | Interspeech | Hyper-parameter Adaptation of Conformer ASR Systems for Elderly and Dysarthric Speech Recognition. | Tianzi Wang, Shoukang Hu, Jiajun Deng, Zengrui Jin, Mengzhe Geng, Yi Wang, Helen Meng, Xunying Liu |
| 2023 | Interspeech | SememeASR: Boosting Performance of End-to-End Speech Recognition against Domain and Long-Tailed Data Shift with Sememe Semantic Knowledge. | Jiaxu Zhu, Changhe Song, Zhiyong Wu, Helen Meng |
| 2023 | Interspeech | Text-Only Domain Adaptation for End-to-End Speech Recognition through Down-Sampling Acoustic Representation. | Jiaxu Zhu, Weinan Tong, Yaoxun Xu, Changhe Song, Zhiyong Wu, Zhao You, Dan Su, Dong Yu, Helen Meng |
| 2022 | ACL | On Controlling Fallback Responses for Grounded Dialogue Generation. | Hongyuan Lu, Wai Lam, Hong Cheng, Helen Meng |
| 2022 | CHI | TalkTive: A Conversational Agent Using Backchannels to Engage Older Adults in Neurocognitive Disorders Screening. | Zijian Ding, Jiawen Kang, Tinky Oi Ting Ho, Ka Ho Wong, Helene H. Fung, Helen Meng, Xiaojuan Ma |
| 2022 | COLING | Unsupervised Multi-scale Expressive Speaking Style Modeling with Hierarchical Context Information for Audiobook Speech Synthesis. | Xueyuan Chen, Shun Lei, Zhiyong Wu, Dong Xu, Weifeng Zhao, Helen Meng |
| 2022 | EMNLP | COLD: A Benchmark for Chinese Offensive Language Detection. | Jiawen Deng, Jingyan Zhou, Hao Sun, Chujie Zheng, Fei Mi, Helen Meng, Minlie Huang |
| 2022 | EMNLP | Towards Identifying Social Bias in Dialog Systems: Framework, Dataset, and Benchmark. | Jingyan Zhou, Jiawen Deng, Fei Mi, Yitong Li, Yasheng Wang, Minlie Huang, Xin Jiang, Qun Liu, Helen Meng |
| 2022 | ICASSP | A Character-Level Span-Based Model for Mandarin Prosodic Structure Prediction. | Xueyuan Chen, Changhe Song, Yixuan Zhou, Zhiyong Wu, Changbin Chen, Zhongqin Wu, Helen Meng |
| 2022 | ICASSP | FullSubNet+: Channel Attention Fullsubnet with Complex Spectrograms for Speech Enhancement. | Jun Chen, Zilin Wang, Deyi Tuo, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2022 | ICASSP | An End-to-End Chinese Text Normalization Model Based on Rule-Guided Flat-Lattice Transformer. | Wenlin Dai, Changhe Song, Xiang Li, Zhiyong Wu, Huashan Pan, Xiulin Li, Helen Meng |
| 2022 | ICASSP | Exploiting Cross Domain Acoustic-to-Articulatory Inverted Features for Disordered Speech Recognition. | Shujie Hu, Shansong Liu, Xurong Xie, Mengzhe Geng, Tianzi Wang, Shoukang Hu, Mingyu Cui, Xunying Liu, Helen Meng |
| 2022 | ICASSP | Towards Expressive Speaking Style Modelling with Hierarchical Context Information for Mandarin Speech Synthesis. | Shun Lei, Yixuan Zhou, Liyang Chen, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2022 | ICASSP | Enhancing Speaking Styles in Conversational Text-to-Speech Synthesis with Graph-Based Multi-Modal Context Modeling. | Jingbei Li, Yi Meng, Chenyi Li, Zhiyong Wu, Helen Meng, Chao Weng, Dan Su |
| 2022 | ICASSP | Neufa: Neural Network Based End-to-End Forced Alignment with Bidirectional Attention Mechanism. | Jingbei Li, Yi Meng, Zhiyong Wu, Helen Meng, Qiao Tian, Yuping Wang, Yuxuan Wang |
| 2022 | ICASSP | Audio-Visual Multi-Channel Speech Separation, Dereverberation and Recognition. | Guinan Li, Jianwei Yu, Jiajun Deng, Xunying Liu, Helen Meng |
| 2022 | ICASSP | A Multitask Learning Framework for Speaker Change Detection with Content Information from Unsupervised Speech Decomposition. | Hang Su, Danyang Zhao, Long Dang, Minglei Li, Xixin Wu, Xunying Liu, Helen Meng |
| 2022 | ICASSP | Speaker Identity Preservation in Dysarthric Speech Reconstruction by Adversarial Speaker Adaptation. | Disong Wang, Songxiang Liu, Xixin Wu, Hui Lu, Lifa Sun, Xunying Liu, Helen Meng |
| 2022 | ICASSP | VCVTS: Multi-Speaker Video-to-Speech Synthesis Via Cross-Modal Knowledge Transfer from Voice Conversion. | Disong Wang, Shan Yang, Dan Su, Xunying Liu, Dong Yu, Helen Meng |
| 2022 | ICASSP | Adversarial Sample Detection for Speaker Verification by Neural Vocoders. | Haibin Wu, Po-Chun Hsu, Ji Gao, Shanshan Zhang, Shen Huang, Jian Kang, Zhiyong Wu, Helen Meng, Hung-Yi Lee |
| 2022 | ICASSP | Neural Architecture Search for Speech Emotion Recognition. | Xixin Wu, Shoukang Hu, Zhiyong Wu, Xunying Liu, Helen Meng |
| 2022 | ICASSP | Partially Fake Audio Detection by Self-Attention-Based Fake Span Discovery. | Haibin Wu, Heng-Cheng Kuo, Naijun Zheng, Kuo-Hsuan Hung, Hung-Yi Lee, Yu Tsao, Hsin-Min Wang, Helen Meng |
| 2022 | ICASSP | Characterizing the Adversarial Vulnerability of Speech self-Supervised Learning. | Haibin Wu, Bo Zheng, Xu Li, Xixin Wu, Hung-Yi Lee, Helen Meng |
| 2022 | ICASSP | Mixed Precision DNN Quantization for Overlapped Speech Separation and Recognition. | Junhao Xu, Jianwei Yu, Xunying Liu, Helen Meng |
| 2022 | ICASSP | Disentangling Content and Fine-Grained Prosody Information Via Hybrid ASR Bottleneck Features for Voice Conversion. | Xintao Zhao, Feng Liu, Changhe Song, Zhiyong Wu, Shiyin Kang, Deyi Tuo, Helen Meng |
| 2022 | ICASSP | The CUHK-Tencent Speaker Diarization System for the ICASSP 2022 Multi-Channel Multi-Party Meeting Transcription Challenge. | Naijun Zheng, Na Li, Xixin Wu, Lingwei Meng, Jiawen Kang, Haibin Wu, Chao Weng, Dan Su, Helen Meng |
| 2022 | ICASSP | Multi-Channel Speaker Diarization Using Spatial Features for Meetings. | Naijun Zheng, Na Li, Jianwei Yu, Chao Weng, Dan Su, Xunying Liu, Helen Meng |
| 2022 | Interspeech | Speech Enhancement with Fullband-Subband Cross-Attention Network. | Jun Chen, Wei Rao, Zilin Wang, Zhiyong Wu, Yannan Wang, Tao Yu, Shidong Shang, Helen Meng |
| 2022 | Interspeech | Improving Mandarin Prosodic Structure Prediction with Multi-level Contextual Information. | Jie Chen, Changhe Song, Deyi Tuo, Xixin Wu, Shiyin Kang, Zhiyong Wu, Helen Meng |
| 2022 | Interspeech | Two-pass Decoding and Cross-adaptation Based System Combination of End-to-end Conformer and Hybrid TDNN ASR Systems. | Mingyu Cui, Jiajun Deng, Shoukang Hu, Xurong Xie, Tianzi Wang, Shujie Hu, Mengzhe Geng, Boyang Xue, Xunying Liu, Helen Meng |
| 2022 | Interspeech | Confidence Score Based Conformer Speaker Adaptation for Speech Recognition. | Jiajun Deng, Xurong Xie, Tianzi Wang, Mingyu Cui, Boyang Xue, Zengrui Jin, Mengzhe Geng, Guinan Li, Xunying Liu, Helen Meng |
| 2022 | Interspeech | A Multi-Scale Time-Frequency Spectrogram Discriminator for GAN-based Non-Autoregressive TTS. | Haohan Guo, Hui Lu, Xixin Wu, Helen Meng |
| 2022 | Interspeech | A Multi-Stage Multi-Codebook VQ-VAE Approach to High-Performance Neural TTS. | Haohan Guo, Feng-Long Xie, Frank K. Soong, Xixin Wu, Helen Meng |
| 2022 | Interspeech | Towards Multi-Scale Speaking Style Modelling with Hierarchical Context Information for Mandarin Speech Synthesis. | Shun Lei, Yixuan Zhou, Liyang Chen, Jiankun Hu, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2022 | Interspeech | Towards Cross-speaker Reading Style Transfer on Audiobook Dataset. | Xiang Li, Changhe Song, Xianhao Wei, Zhiyong Wu, Jia Jia, Helen Meng |
| 2022 | Interspeech | Context-aware Multimodal Fusion for Emotion Recognition. | Jinchao Li, Shuai Wang, Yang Chao, Xunying Liu, Helen Meng |
| 2022 | Interspeech | CALM: Constrastive Cross-modal Speaking Style Modeling for Expressive Text-to-Speech Synthesis. | Yi Meng, Xiang Li, Zhiyong Wu, Tingtian Li, Zixun Sun, Xinyu Xiao, Chi Sun, Hui Zhan, Helen Meng |
| 2022 | Interspeech | Conformer Based Elderly Speech Recognition System for Alzheimer's Disease Detection. | Tianzi Wang, Jiajun Deng, Mengzhe Geng, Zi Ye, Shoukang Hu, Yi Wang, Mingyu Cui, Zengrui Jin, Xunying Liu, Helen Meng |
| 2022 | Interspeech | Exploring linguistic feature and model combination for speech recognition based automatic AD detection. | Yi Wang, Tianzi Wang, Zi Ye, Lingwei Meng, Shoukang Hu, Xixin Wu, Xunying Liu, Helen Meng |
| 2022 | Interspeech | Spoofing-Aware Speaker Verification by Multi-Level Fusion. | Haibin Wu, Lingwei Meng, Jiawen Kang, Jinchao Li, Xu Li, Xixin Wu, Hung-yi Lee, Helen Meng |
| 2022 | Interspeech | Towards Green ASR: Lossless 4-bit Quantization of a Hybrid TDNN System on the 300-hr Swithboard Corpus. | Junhao Xu, Shoukang Hu, Xunying Liu, Helen Meng |
| 2022 | Interspeech | Speech Representation Disentanglement with Adversarial Mutual Information Learning for One-shot Voice Conversion. | Sicheng Yang, Methawee Tantrawenith, Haolin Zhuang, Zhiyong Wu, Aolan Sun, Jianzong Wang, Ning Cheng, Huaizhen Tang, Xintao Zhao, Jie Wang, Helen Meng |
| 2022 | Interspeech | MFA-Conformer: Multi-scale Feature Aggregation Conformer for Automatic Speaker Verification. | Yang Zhang, Zhiqiang Lv, Haibin Wu, Shanshan Zhang, Pengfei Hu, Zhiyong Wu, Hung-yi Lee, Helen Meng |
| 2022 | Interspeech | Towards Improving the Expressiveness of Singing Voice Synthesis with BERT Derived Semantic Information. | Shaohuan Zhou, Shun Lei, Weiya You, Deyi Tuo, Yuren You, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2022 | Interspeech | Enhancing Word-Level Semantic Representation via Dependency Structure for Expressive Text-to-Speech Synthesis. | Yixuan Zhou, Changhe Song, Jingbei Li, Zhiyong Wu, Yanyao Bian, Dan Su, Helen Meng |
| 2022 | Interspeech | Content-Dependent Fine-Grained Speaker Embedding for Zero-Shot Speaker Adaptation in Text-to-Speech Synthesis. | Yixuan Zhou, Changhe Song, Xiang Li, Luwen Zhang, Zhiyong Wu, Yanyao Bian, Dan Su, Helen Meng |
| 2022 | NAACL | Partner Personas Generation for Dialogue Response Generation. | Hongyuan Lu, Wai Lam, Hong Cheng, Helen Meng |
| 2022 | WWW | User Satisfaction Estimation with Sequential Dialogue Act Modeling in Goal-oriented Conversational Systems. | Yang Deng, Wenxuan Zhang, Wai Lam, Hong Cheng, Helen Meng |
| 2022 | SIGdial | Toward Self-Learning End-to-End Task-oriented Dialog Systems. | Xiaoying Zhang, Baolin Peng, Jianfeng Gao, Helen Meng |
| 2021 | ASRU | DiffSVC: A Diffusion Probabilistic Model for Singing Voice Conversion. | Songxiang Liu, Yuewen Cao, Dan Su, Helen Meng |
| 2021 | ASRU | Reconstructing Dual Learning for Neural Voice Conversion Using Relatively Few Samples. | Aolan Sun, Jianzong Wang, Ning Cheng, Methawee Tantrawenith, Zhiyong Wu, Helen Meng, Edward Xiao, Jing Xiao |
| 2021 | ICASSP | Emotion Controllable Speech Synthesis Using Emotion-Unlabeled Dataset with the Assistance of Cross-Domain Speech Emotion Recognition. | Xiong Cai, Dongyang Dai, Zhiyong Wu, Xiang Li, Jingbei Li, Helen Meng |
| 2021 | ICASSP | Neural Architecture Search for LF-MMI Trained Time Delay Neural Networks. | Shoukang Hu, Xurong Xie, Shansong Liu, Mingyu Cui, Mengzhe Geng, Xunying Liu, Helen Meng |
| 2021 | ICASSP | Replay and Synthetic Speech Detection with Res2Net Architecture. | Xu Li, Na Li, Chao Weng, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2021 | ICASSP | A Comparative Study of Acoustic and Linguistic Features Classification for Alzheimer's Disease Detection. | Jinchao Li, Jianwei Yu, Zi Ye, Simon Wong, Man-Wai Mak, Brian Mak, Xunying Liu, Helen Meng |
| 2021 | ICASSP | Fcl-Taco2: Towards Fast, Controllable and Lightweight Text-to-Speech Synthesis. | Disong Wang, Liqun Deng, Yang Zhang, Nianzu Zheng, Yu Ting Yeung, Xiao Chen, Xunying Liu, Helen Meng |
| 2021 | ICASSP | The Huya Multi-Speaker and Multi-Style Speech Synthesis System for M2voc Challenge 2020. | Jie Wang, Yuren You, Feng Liu, Deyi Tuo, Shiyin Kang, Zhiyong Wu, Helen Meng |
| 2021 | ICASSP | Adversarial Defense for Automatic Speaker Verification by Cascaded Self-Supervised Learning Models. | Haibin Wu, Xu Li, Andy T. Liu, Zhiyong Wu, Helen Meng, Hung-yi Lee |
| 2021 | ICASSP | Bayesian Transformer Language Models for Speech Recognition. | Boyang Xue, Jianwei Yu, Junhao Xu, Shansong Liu, Shoukang Hu, Zi Ye, Mengzhe Geng, Xunying Liu, Helen Meng |
| 2021 | ICASSP | Mixed Precision Quantization of Transformer Language Models for Speech Recognition. | Junhao Xu, Shoukang Hu, Jianwei Yu, Xunying Liu, Helen Meng |
| 2021 | ICASSP | Development of the Cuhk Elderly Speech Recognition System for Neurocognitive Disorder Detection Using the Dementiabank Corpus. | Zi Ye, Shoukang Hu, Jinchao Li, Xurong Xie, Mengzhe Geng, Jianwei Yu, Junhao Xu, Boyang Xue, Shansong Liu, Xunying Liu, Helen Meng |
| 2021 | ICASSP | A Joint Training Framework of Multi-Look Separator and Speaker Embedding Extractor for Overlapped Speech. | Naijun Zheng, Na Li, Bo Wu, Meng Yu, Jianwei Yu, Chao Weng, Dan Su, Xunying Liu, Helen Meng |
| 2021 | Interspeech | Bayesian Parametric and Architectural Domain Adaptation of LF-MMI Trained TDNNs for Elderly and Dysarthric Speech Recognition. | Jiajun Deng, Fabian Ritter Gutierrez, Shoukang Hu, Mengzhe Geng, Xurong Xie, Zi Ye, Shansong Liu, Jianwei Yu, Xunying Liu, Helen Meng |
| 2021 | Interspeech | Spectro-Temporal Deep Features for Disordered Speech Assessment and Recognition. | Mengzhe Geng, Shansong Liu, Jianwei Yu, Xurong Xie, Shoukang Hu, Zi Ye, Zengrui Jin, Xunying Liu, Helen Meng |
| 2021 | Interspeech | Adversarial Data Augmentation for Disordered Speech Recognition. | Zengrui Jin, Mengzhe Geng, Xurong Xie, Jianwei Yu, Shansong Liu, Xunying Liu, Helen Meng |
| 2021 | Interspeech | Towards Multi-Scale Style Control for Expressive Speech Synthesis. | Xiang Li, Changhe Song, Jingbei Li, Zhiyong Wu, Jia Jia, Helen Meng |
| 2021 | Interspeech | Channel-Wise Gated Res2Net: Towards Robust Detection of Synthetic Speech Attacks. | Xu Li, Xixin Wu, Hui Lu, Xunying Liu, Helen Meng |
| 2021 | Interspeech | VAENAR-TTS: Variational Auto-Encoder Based Non-AutoRegressive Text-to-Speech Synthesis. | Hui Lu, Zhiyong Wu, Xixin Wu, Xu Li, Shiyin Kang, Xunying Liu, Helen Meng |
| 2021 | Interspeech | VQMIVC: Vector Quantization and Mutual Information-Based Unsupervised Speech Representation Disentanglement for One-Shot Voice Conversion. | Disong Wang, Liqun Deng, Yu Ting Yeung, Xiao Chen, Xunying Liu, Helen Meng |
| 2021 | Interspeech | Unsupervised Domain Adaptation for Dysarthric Speech Detection via Domain Adversarial Training and Mutual Information Minimization. | Disong Wang, Liqun Deng, Yu Ting Yeung, Xiao Chen, Xunying Liu, Helen Meng |
| 2021 | Interspeech | Learning Explicit Prosody Models and Deep Speaker Embeddings for Atypical Voice Conversion. | Disong Wang, Songxiang Liu, Lifa Sun, Xixin Wu, Xunying Liu, Helen Meng |
| 2021 | Interspeech | Adversarially Learning Disentangled Speech Representations for Robust Multi-Factor Voice Conversion. | Jie Wang, Jingbei Li, Xintao Zhao, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2021 | Interspeech | Transformer Based End-to-End Mispronunciation Detection and Diagnosis. | Minglin Wu, Kun Li, Wai-Kim Leung, Helen Meng |
| 2020 | ICASSP | Code-Switched Speech Synthesis Using Bilingual Phonetic Posteriorgram with Only Monolingual Corpora. | Yuewen Cao, Songxiang Liu, Xixin Wu, Shiyin Kang, Peng Liu, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2020 | ICASSP | End-To-End Accent Conversion Without Using Native Utterances. | Songxiang Liu, Disong Wang, Yuewen Cao, Lifa Sun, Xixin Wu, Shiyin Kang, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2020 | ICASSP | Adversarial Attacks on GMM I-Vector Based Speaker Verification Systems. | Xu Li, Jinghua Zhong, Xixin Wu, Jianwei Yu, Xunying Liu, Helen Meng |
| 2020 | ICASSP | End-To-End Voice Conversion Via Cross-Modal Knowledge Distillation for Dysarthric Speech Reconstruction. | Disong Wang, Jianwei Yu, Xixin Wu, Songxiang Liu, Lifa Sun, Xunying Liu, Helen Meng |
| 2020 | ICASSP | Defense Against Adversarial Attacks on Spoofing Countermeasures of ASV. | Haibin Wu, Songxiang Liu, Helen Meng, Hung-yi Lee |
| 2020 | ICASSP | Low-bit Quantization of Recurrent Neural Network Language Models Using Alternating Direction Methods of Multipliers. | Junhao Xu, Xie Chen, Shoukang Hu, Jianwei Yu, Xunying Liu, Helen Meng |
| 2020 | ICASSP | Audio-Visual Recognition of Overlapped Speech for the LRS2 Dataset. | Jianwei Yu, Shi-Xiong Zhang, Jian Wu, Shahram Ghorbani, Bo Wu, Shiyin Kang, Shansong Liu, Xunying Liu, Helen Meng, Dong Yu |
| 2020 | Interspeech | Investigation of Data Augmentation Techniques for Disordered Speech Recognition. | Mengzhe Geng, Xurong Xie, Shansong Liu, Jianwei Yu, Shoukang Hu, Xunying Liu, Helen Meng |
| 2020 | Interspeech | Enhancing Monotonicity for Robust Autoregressive Transformer TTS. | Xiangyu Liang, Zhiyong Wu, Runnan Li, Yanqing Liu, Sheng Zhao, Helen Meng |
| 2020 | Interspeech | Investigating Robustness of Adversarial Samples Detection for Automatic Speaker Verification. | Xu Li, Na Li, Jinghua Zhong, Xixin Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2020 | Interspeech | Group Gated Fusion on Attention-Based Bidirectional Alignment for Multimodal Emotion Recognition. | Pengfei Liu, Kun Li, Helen Meng |
| 2020 | Interspeech | Transferring Source Style in Non-Parallel Voice Conversion. | Songxiang Liu, Yuewen Cao, Shiyin Kang, Na Hu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2020 | Interspeech | Exploiting Cross-Domain Visual Feature Generation for Disordered Speech Recognition. | Shansong Liu, Xurong Xie, Jianwei Yu, Shoukang Hu, Mengzhe Geng, Rongfeng Su, Shi-Xiong Zhang, Xunying Liu, Helen Meng |
| 2020 | Interspeech | SpecSwap: A Simple Data Augmentation Method for End-to-End Speech Recognition. | Xingcheng Song, Zhiyong Wu, Yiheng Huang, Dan Su, Helen Meng |
| 2020 | Interspeech | Speech-XLNet: Unsupervised Acoustic Model Pretraining for Self-Attention Networks. | Xingchen Song, Guangsen Wang, Yiheng Huang, Zhiyong Wu, Dan Su, Helen Meng |
| 2020 | Interspeech | Audio-Visual Multi-Channel Recognition of Overlapped Speech. | Jianwei Yu, Bo Wu, Rongzhi Gu, Shi-Xiong Zhang, Lianwu Chen, Yong Xu, Meng Yu, Dan Su, Dong Yu, Xunying Liu, Helen Meng |
| 2020 | Interspeech | Re-Weighted Interval Loss for Handling Data Imbalance Problem of End-to-End Keyword Spotting. | Kun Zhang, Zhiyong Wu, Daode Yuan, Jian Luan, Jia Jia, Helen Meng, Binheng Song |
| 2020 | Interspeech | Speaker-Aware Linear Discriminant Analysis in Speaker Verification. | Naijun Zheng, Xixin Wu, Jinghua Zhong, Xunying Liu, Helen Meng |
| 2019 | ASRU | Adversarial Attacks on Spoofing Countermeasures of Automatic Speaker Verification. | Songxiang Liu, Haibin Wu, Hung-yi Lee, Helen Meng |
| 2019 | ICASSP | End-to-end Code-switched TTS with Mix of Monolingual Recordings. | Yuewen Cao, Xixin Wu, Songxiang Liu, Jianwei Yu, Xu Li, Zhiyong Wu, Xunying Liu, Helen Meng |
| 2019 | ICASSP | Learning Discriminative Features from Spectrograms Using Center Loss for Speech Emotion Recognition. | Dongyang Dai, Zhiyong Wu, Runnan Li, Xixin Wu, Jia Jia, Helen Meng |
| 2019 | ICASSP | Bayesian and Gaussian Process Neural Networks for Large Vocabulary Continuous Speech Recognition. | Shoukang Hu, Max W. Y. Lam, Xurong Xie, Shansong Liu, Jianwei Yu, Xixin Wu, Xunying Liu, Helen Meng |
| 2019 | ICASSP | Gaussian Process Lstm Recurrent Neural Network Language Models for Speech Recognition. | Max W. Y. Lam, Xie Chen, Shoukang Hu, Jianwei Yu, Xunying Liu, Helen Meng |
| 2019 | ICASSP | CNN-RNN-CTC Based End-to-end Mispronunciation Detection and Diagnosis. | Wai-Kim Leung, Xunying Liu, Helen Meng |
| 2019 | ICASSP | Dilated Residual Network with Multi-head Self-attention for Speech Emotion Recognition. | Runnan Li, Zhiyong Wu, Jia Jia, Sheng Zhao, Helen Meng |
| 2019 | ICASSP | A Compact Framework for Voice Conversion Using Wavenet Conditioned on Phonetic Posteriorgrams. | Hui Lu, Zhiyong Wu, Runnan Li, Shiyin Kang, Jia Jia, Helen Meng |
| 2019 | ICASSP | Quasi-fully Convolutional Neural Network with Variational Inference for Speech Synthesis. | Mu Wang, Xixin Wu, Zhiyong Wu, Shiyin Kang, Deyi Tuo, Guangzhi Li, Dan Su, Dong Yu, Helen Meng |
| 2019 | ICASSP | Speech Emotion Recognition Using Capsule Networks. | Xixin Wu, Songxiang Liu, Yuewen Cao, Xu Li, Jianwei Yu, Dongyang Dai, Xi Ma, Shoukang Hu, Zhiyong Wu, Xunying Liu, Helen Meng |
| 2019 | ICASSP | Recurrent Neural Network Language Model Training Using Natural Gradient. | Jianwei Yu, Max W. Y. Lam, Xie Chen, Shoukang Hu, Songxiang Liu, Xixin Wu, Xunying Liu, Helen Meng |
| 2019 | IJCAI | Towards Discriminative Representation Learning for Speech Emotion Recognition. | Runnan Li, Zhiyong Wu, Jia Jia, Yaohua Bu, Sheng Zhao, Helen Meng |
| 2019 | Interspeech | Disambiguation of Chinese Polyphones in an End-to-End Framework with Semantic Features Extracted by Pre-Trained BERT. | Dongyang Dai, Zhiyong Wu, Shiyin Kang, Xixin Wu, Jia Jia, Dan Su, Dong Yu, Helen Meng |
| 2019 | Interspeech | The CUHK Dysarthric Speech Recognition Systems for English and Cantonese. | Shoukang Hu, Shansong Liu, Heng Fai Chang, Mengzhe Geng, Jiani Chen, Lau Wing Chung, To Ka Hei, Jianwei Yu, Ka Ho Wong, Xunying Liu, Helen Meng |
| 2019 | Interspeech | LF-MMI Training of Bayesian and Gaussian Process Time Delay Neural Networks for Speech Recognition. | Shoukang Hu, Xurong Xie, Shansong Liu, Max W. Y. Lam, Jianwei Yu, Xixin Wu, Xunying Liu, Helen Meng |
| 2019 | Interspeech | Extract, Adapt and Recognize: An End-to-End Neural Network for Corrupted Monaural Speech Recognition. | Max W. Y. Lam, Jun Wang, Xunying Liu, Helen Meng, Dan Su, Dong Yu |
| 2019 | Interspeech | Jointly Trained Conversion Model and WaveNet Vocoder for Non-Parallel Voice Conversion Using Mel-Spectrograms and Phonetic Posteriorgrams. | Songxiang Liu, Yuewen Cao, Xixin Wu, Lifa Sun, Xunying Liu, Helen Meng |
| 2019 | Interspeech | On the Use of Pitch Features for Disordered Speech Recognition. | Shansong Liu, Shoukang Hu, Xunying Liu, Helen Meng |
| 2019 | Interspeech | Exploiting Visual Features Using Bayesian Gated Neural Networks for Disordered Speech Recognition. | Shansong Liu, Shoukang Hu, Yi Wang, Jianwei Yu, Rongfeng Su, Xunying Liu, Helen Meng |
| 2019 | Interspeech | Knowledge-Based Linguistic Encoding for End-to-End Mandarin Text-to-Speech Synthesis. | Jingbei Li, Zhiyong Wu, Runnan Li, Pengpeng Zhi, Song Yang, Helen Meng |
| 2019 | Interspeech | One-Shot Voice Conversion with Global Speaker Embeddings. | Hui Lu, Zhiyong Wu, Dongyang Dai, Runnan Li, Shiyin Kang, Jia Jia, Helen Meng |
| 2019 | Interspeech | Unsupervised Methods for Audio Classification from Lecture Discussion Recordings. | Hang Su, Borislav Dzodzo, Xixin Wu, Xunying Liu, Helen Meng |
| 2019 | Interspeech | Comparative Study of Parametric and Representation Uncertainty Modeling for Recurrent Neural Network Language Models. | Jianwei Yu, Max W. Y. Lam, Shoukang Hu, Xixin Wu, Xu Li, Yuewen Cao, Xunying Liu, Helen Meng |
| 2019 | WWW | Semi-Supervised Graph Classification: A Hierarchical Graph Perspective. | Jia Li, Yu Rong, Hong Cheng, Helen Meng, Wen-bing Huang, Junzhou Huang |
| 2018 | ICASSP | Limited-Memory BFGS Optimization of Recurrent Neural Network Language Models for Speech Recognition. | Xunying Liu, Shansong Liu, Jinze Sha, Jianwei Yu, Zhiyuan Xu, Xie Chen, Helen Meng |
| 2018 | ICASSP | Emphatic Speech Generation with Conditioned Input Layer and Bidirectional LSTMS for Expressive Speech Synthesis. | Runnan Li, Zhiyong Wu, Yuchen Huang, Jia Jia, Helen Meng, Lianhong Cai |
| 2018 | ICASSP | Unsupervised Discovery of an Extended Phoneme Set in L2 English Speech for Mispronunciation Detection and Diagnosis. | Shaoguang Mao, Xu Li, Kun Li, Zhiyong Wu, Xunying Liu, Helen Meng |
| 2018 | ICASSP | Applying Multitask Learning to Acoustic-Phonemic Model for Mispronunciation Detection and Diagnosis in L2 English Speech. | Shaoguang Mao, Zhiyong Wu, Runnan Li, Xu Li, Helen Meng, Lianhong Cai |
| 2018 | ICASSP | Feature Based Adaptation for Speaking Style Synthesis. | Xixin Wu, Lifa Sun, Shiyin Kang, Songxiang Liu, Zhiyong Wu, Xunying Liu, Helen Meng |
| 2018 | Interspeech | Gaussian Process Neural Networks for Speech Recognition. | Max W. Y. Lam, Shoukang Hu, Xurong Xie, Shansong Liu, Jianwei Yu, Rongfeng Su, Xunying Liu, Helen Meng |
| 2018 | Interspeech | Unsupervised Discovery of Non-native Phonetic Patterns in L2 English Speech for Mispronunciation Detection and Diagnosis. | Xu Li, Shaoguang Mao, Xixin Wu, Kun Li, Xunying Liu, Helen Meng |
| 2018 | Interspeech | Voice Conversion Across Arbitrary Speakers Based on a Single Target-Speaker Utterance. | Songxiang Liu, Jinghua Zhong, Lifa Sun, Xixin Wu, Xunying Liu, Helen Meng |
| 2018 | Interspeech | Emotion Recognition from Variable-Length Speech Segments Using Deep Learning on Spectrograms. | Xi Ma, Zhiyong Wu, Jia Jia, Mingxing Xu, Helen Meng, Lianhong Cai |
| 2018 | Interspeech | Speech and Language Processing for Learning and Wellbeing. | Helen Meng |
| 2018 | Interspeech | Rapid Style Adaptation Using Residual Error Embedding for Expressive Speech Synthesis. | Xixin Wu, Yuewen Cao, Mu Wang, Songxiang Liu, Shiyin Kang, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2018 | Interspeech | Detection of Glottal Closure Instants from Speech Signals: A Convolutional Neural Network Based Method. | Shuai Yang, Zhiyong Wu, Binbin Shen, Helen Meng |
| 2018 | Interspeech | Development of the CUHK Dysarthric Speech Recognition System for the UA Speech Corpus. | Jianwei Yu, Xurong Xie, Shansong Liu, Shoukang Hu, Max W. Y. Lam, Xixin Wu, Ka Ho Wong, Xunying Liu, Helen Meng |
| 2018 | Interspeech | Siamese Recurrent Auto-Encoder Representation for Query-by-Example Spoken Term Detection. | Ziwei Zhu, Zhiyong Wu, Runnan Li, Helen Meng, Lianhong Cai |
| 2018 | KDD | TATC: Predicting Alzheimer's Disease with Actigraphy Data. | Jia Li, Yu Rong, Helen Meng, Zhihui Lu, Timothy C. Y. Kwok, Hong Cheng |
| 2017 | Interspeech | Multi-Task Learning for Prosodic Structure Generation Using BLSTM RNN with Structured Output Layer. | Yuchen Huang, Zhiyong Wu, Runnan Li, Helen Meng, Lianhong Cai |
| 2017 | Interspeech | Spectro-Temporal Modelling with Time-Frequency LSTM and Structured Output Layer for Voice Conversion. | Runnan Li, Zhiyong Wu, Yishuang Ning, Lifa Sun, Helen Meng, Lianhong Cai |
| 2017 | Interspeech | Speech Emotion Recognition with Emotion-Pair Based Framework Considering Emotion Distribution Information in Dimensional Emotion Space. | Xi Ma, Zhiyong Wu, Jia Jia, Mingxing Xu, Helen Meng, Lianhong Cai |
| 2017 | Interspeech | DNN i-Vector Speaker Verification with Short, Text-Constrained Test Utterances. | Jinghua Zhong, Wenping Hu, Frank K. Soong, Helen Meng |
| 2016 | ICASSP | Low level descriptors based DBLSTM bottleneck feature for speech driven talking avatar. | Xinyu Lan, Xu Li, Yishuang Ning, Zhiyong Wu, Helen Meng, Jia Jia, Lianhong Cai |
| 2016 | ICASSP | Question detection from acoustic features using recurrent neural network with gated recurrent unit. | Yaodong Tang, Yuchen Huang, Zhiyong Wu, Helen Meng, Mingxing Xu, Lianhong Cai |
| 2016 | ICASSP | Learning cross-lingual information with multilingual BLSTM for speech synthesis of low-resource languages. | Quanjie Yu, Peng Liu, Zhiyong Wu, Shiyin Kang, Helen Meng, Lianhong Cai |
| 2015 | ICASSP | AA spectral space warping approach to cross-lingual voice transformation in HMM-based TTS. | Hao Wang, Frank K. Soong, Helen Meng |
| 2015 | IJCAI | Modelling High-Dimensional Sequences with LSTM-RTRBM: Application to Polyphonic Music Generation. | Qi Lyu, Zhiyong Wu, Jun Zhu, Helen Meng |
| 2014 | ICASSP | Phonological modeling of mispronunciation gradations in L2 English speech of L1 Chinese learners. | Hao Wang, Xiaojun Qian, Helen Meng |
| 2014 | ICASSP | Learning dynamic features with neural networks for phoneme recognition. | Xin Zheng, Zhiyong Wu, Helen Meng, Lianhong Cai |
| 2014 | ICASSP | Contrastive auto-encoder for phoneme recognition. | Xin Zheng, Zhiyong Wu, Helen Meng, Lianhong Cai |
| 2013 | ICASSP | Multi-distribution deep belief network for speech synthesis. | Shiyin Kang, Xiaojun Qian, Helen Meng |
| 2013 | Interspeech | Lexical stress detection for L2 English speech using deep belief networks. | Kun Li, Xiaojun Qian, Shiyin Kang, Helen Meng |
| 2009 | Interspeech | Studying L2 suprasegmental features in asian Englishes: a position paper. | Helen Meng, Chiu-yu Tseng, Mariko Kondo, Alissa M. Harrison, Tanya Visceglia |
| 2009 | PACLIC | Developing Speech Recognition and Synthesis Technologies to Support Computer-Aided Pronunciation Training for Chinese Learners of English. | Helen Meng |
| 2007 | NAACL | Combined Use of Speaker- and Tone-Normalized Pitch Reset with Pause Duration for Automatic Story Segmentation in Mandarin Broadcast News. | Lei Xie, Chuan Liu, Helen Meng |
| 2006 | ICASSP | A Comparative Study of Discriminative Methods for Reranking LVCSR N-Best Hypotheses in Domain Adaptation and Generalization. | Zhengyu Zhou, Jianfeng Gao, Frank K. Soong, Helen Meng |
| 2005 | NAACL | The Use of Metadata, Web-derived Answer Patterns and Passage Context to Improve Reading Comprehension Performance. | Yongping Du, Helen Meng, Xuanjing Huang, Lide Wu |
| 2004 | ICASSP | English-Chinese bilingual text-independent speaker verification. | Bin Ma, Helen Meng |
| 2004 | ICASSP | Bilingual Chinese/English voice browsing based on a VoiceXML platform. | Helen Meng, Yuk-Chi Li, Tien Ying Fung, Kon Fan Low, Ka-Fai Chow, Tin Hang Lo, Man Cheuk Ho, P. C. Ching |