| 2026 | AAAI | Multiplicative Orthogonal Sequential Editing for Language Models. | Hao-Xiang Xu, Jun-Yu Ma, Ziqi Peng, Yuhao Sun, Zhen-Hua Ling, Jia-Chen Gu |
| 2026 | AAAI | Say More with Less: Variable-Frame-Rate Speech Tokenization via Adaptive Clustering and Implicit Duration Coding. | Rui-Chen Zheng, Wenrui Liu, Hui-Peng Du, Qinglin Zhang, Chong Deng, Qian Chen, Wen Wang, Yang Ai, Zhen-Hua Ling |
| 2026 | ACL | UniVocal: Unified Speech-Singing Code-Switching Synthesis. | Yufei Shi, Qian Chen, Wen Wang, Xiangang Li, Zhen-Hua Ling, Yang Ai |
| 2026 | ACL | GenesisFunc: Multi-Agent Data Generation for Accurate and Generalizable Function-Calling. | Hao-Xiang Xu, Chong Deng, Jiaqing Liu, Wen Wang, Qian Chen, Lujia Bao, Xiangang Li, Zhen-Hua Ling |
| 2025 | ACL | RISE: Reasoning Enhancement via Iterative Self-Exploration in Multi-hop Question Answering. | Bolei He, Xinran He, Mengke Chen, Xianwei Xue, Ying Zhu, Zhen-Hua Ling |
| 2025 | ACL | RPO: Retrieval Preference Optimization for Robust Retrieval-Augmented Generation. | Shi-Qi Yan, Quan Liu, Zhen-Hua Ling |
| 2025 | EMNLP | Select to Know: An Internal-External Knowledge Self-Selection Framework for Domain-Specific Question Answering. | Bolei He, Xinran He, Run Shao, Shanfu Shu, Xianwei Xue, Mingquan Cheng, Haifeng Li, Zhen-Hua Ling |
| 2025 | EMNLP | UniSpeaker: A Unified Approach for Multimodality-driven Speaker Generation. | Zhengyan Sheng, Zhihao Du, Heng Lu, Shiliang Zhang, Zhen-Hua Ling |
| 2025 | ICASSP | The USTC System for EEG-Music Emotion Recognition Challenge. | Jiaxin Chen, Yiming Wang, Yin-Long Liu, Rui Feng, Jiahong Yuan, Zhen-Hua Ling |
| 2025 | ICASSP | CASC-XVC: Zero-Shot Cross-Lingual Voice Conversion with Content Accordant and Speaker Contrastive Losses. | Han-Jie Guo, Hui-Peng Du, Zheng-Yan Sheng, Li-Ping Chen, Yang Ai, Zhen-Hua Ling |
| 2025 | ICASSP | Can Automated Speech Recognition Errors Provide Valuable Clues for Alzheimer's Disease Detection? | Yin-Long Liu, Rui Feng, Ye-Xin Lu, Jia-Xin Chen, Yang Ai, Jia-Hong Yuan, Zhen-Hua Ling |
| 2025 | ICASSP | Self-supervised Prosody Learning at Phoneme-level with Momentum Contrast for Speech Synthesis. | Zhaoci Liu, Ya-Jun Hu, Liping Chen, Zhen-Hua Ling |
| 2025 | ICASSP | Incremental Disentanglement for Environment-Aware Zero-Shot Text-to-Speech Synthesis. | Ye-Xin Lu, Hui-Peng Du, Zheng-Yan Sheng, Yang Ai, Zhen-Hua Ling |
| 2025 | ICASSP | Anchored Monotonic Alignment and Representation Substitution for Rare Spontaneous Behaviors in Spontaneous Speech Synthesis. | Ning-Qian Wu, Ya-Jun Hu, Liping Chen, Zhen-Hua Ling |
| 2025 | ICLR | Perturbation-Restrained Sequential Model Editing. | Jun-Yu Ma, Hong Wang, Hao-Xiang Xu, Zhen-Hua Ling, Jia-Chen Gu |
| 2025 | Interspeech | Decoding Speaker-Normalized Pitch from EEG for Mandarin Perception. | Jia-Xin Chen, Yi-Ming Wang, Ziyu Zhang, Jiayang Han, Yin-Long Liu, Rui Feng, Xiuyuan Liang, Zhen-Hua Ling, Jia-Hong Yuan |
| 2025 | Interspeech | Vision-Integrated High-Quality Neural Speech Coding. | Yao Guo, Yang Ai, Rui-Chen Zheng, Hui-Peng Du, Xiao-Hang Jiang, Zhen-Hua Ling |
| 2025 | Interspeech | Beyond Manual Transcripts: The Potential of Automated Speech Recognition Errors in Improving Alzheimer's Disease Detection. | Yin-Long Liu, Rui Feng, Jia-Xin Chen, Yi-Ming Wang, Jia-Hong Yuan, Zhen-Hua Ling |
| 2025 | Interspeech | Leveraging Cascaded Binary Classification and Multimodal Fusion for Dementia Detection through Spontaneous Speech. | Yin-Long Liu, Yuanchao Li, Rui Feng, Liu He, Jia-Xin Chen, Yi-Ming Wang, Yu-Ang Chen, Yan-Han Peng, Jia-Hong Yuan, Zhen-Hua Ling |
| 2025 | Interspeech | LIST: Language-Independent Speech Token for Multilingual Speech Synthesis with Language Models. | Chang Liu, Zhen-Hua Ling, Yu Gu |
| 2025 | Interspeech | Improving Noise Robustness of LLM-based Zero-shot TTS via Discrete Acoustic Token Denoising. | Ye-Xin Lu, Hui-Peng Du, Fei Liu, Yang Ai, Zhen-Hua Ling |
| 2025 | Interspeech | Universal Preference-Score-based Pairwise Speech Quality Assessment. | Yufei Shi, Yang Ai, Zhen-Hua Ling |
| 2025 | NAACL | Constraining Sequential Model Editing with Editing Anchor Compression. | Hao-Xiang Xu, Jun-Yu Ma, Zhen-Hua Ling, Ningyu Zhang, Jia-Chen Gu |
| 2024 | ACL | X-ACE: Explainable and Multi-factor Audio Captioning Evaluation. | Qian Wang, Jia-Chen Gu, Zhen-Hua Ling |
| 2024 | EMNLP | Model Editing Harms General Abilities of Large Language Models: Regularization to the Rescue. | Jia-Chen Gu, Hao-Xiang Xu, Jun-Yu Ma, Pan Lu, Zhen-Hua Ling, Kai-Wei Chang, Nanyun Peng |
| 2024 | EMNLP | Retrieving, Rethinking and Revising: The Chain-of-Verification Can Improve Retrieval Augmented Generation. | Bolei He, Nuo Chen, Xinran He, Lingyong Yan, Zhenkai Wei, Jinchang Luo, Zhen-Hua Ling |
| 2024 | ICASSP | Modeling Pseudo-Speaker Uncertainty in Voice Anonymization. | Liping Chen, Kong Aik Lee, Wu Guo, Zhen-Hua Ling |
| 2024 | ICASSP | Multiscale Matching Driven by Cross-Modal Similarity Consistency for Audio-Text Retrieval. | Qian Wang, Jia-Chen Gu, Zhen-Hua Ling |
| 2024 | ICASSP | An End-to-End EEG Channel Selection Method with Residual Gumbel Softmax for Brain-Assisted Speech Enhancement. | Qing-Tian Xu, Jie Zhang, Zhen-Hua Ling |
| 2024 | ICML | Neighboring Perturbations of Knowledge Editing on Large Language Models. | Jun-Yu Ma, Zhen-Hua Ling, Ningyu Zhang, Jia-Chen Gu |
| 2024 | Interspeech | A Low-Bitrate Neural Audio Codec Framework with Bandwidth Reduction and Recovery for High-Sampling-Rate Waveforms. | Yang Ai, Ye-Xin Lu, Xiao-Hang Jiang, Zheng-Yan Sheng, Rui-Chen Zheng, Zhen-Hua Ling |
| 2024 | Interspeech | BiVocoder: A Bidirectional Neural Vocoder Integrating Feature Extraction and Waveform Generation. | Hui-Peng Du, Ye-Xin Lu, Yang Ai, Zhen-Hua Ling |
| 2024 | Interspeech | Clever Hans Effect Found in Automatic Detection of Alzheimer's Disease through Speech. | Yin-Long Liu, Rui Feng, Jia-Hong Yuan, Zhen-Hua Ling |
| 2024 | Interspeech | MultiStage Speech Bandwidth Extension with Flexible Sampling Rate Control. | Ye-Xin Lu, Yang Ai, Zheng-Yan Sheng, Zhen-Hua Ling |
| 2024 | Interspeech | Asynchronous Voice Anonymization Using Adversarial Perturbation On Speaker Embedding. | Rui Wang, Liping Chen, Kong Aik Lee, Zhen-Hua Ling |
| 2023 | EMNLP | Symbolization, Prompt, and Classification: A Framework for Implicit Speaker Identification in Novels. | Yue Chen, Tian-Wei He, Hongbin Zhou, Jia-Chen Gu, Heng Lu, Zhen-Hua Ling |
| 2023 | EMNLP | MADNet: Maximizing Addressee Deduction Expectation for Multi-Party Conversation Generation. | Jia-Chen Gu, Chao-Hong Tan, Caiyuan Chu, Zhen-Hua Ling, Chongyang Tao, Quan Liu, Cong Liu |
| 2023 | EMNLP | Is ChatGPT a Good Multi-Party Conversation Solver? | Chao-Hong Tan, Jia-Chen Gu, Zhen-Hua Ling |
| 2023 | ICASSP | Neural Speech Phase Prediction Based on Parallel Estimation Architecture and Anti-Wrapping Losses. | Yang Ai, Zhen-Hua Ling |
| 2023 | ICASSP | Zero-Shot Personalized Lip-To-Speech Synthesis with Face Image Based Voice Control. | Zhengyan Sheng, Yang Ai, Zhen-Hua Ling |
| 2023 | ICASSP | Self-Supervised Audio-Visual Speech Representations Learning by Multimodal Self-Distillation. | Jing-Xuan Zhang, Genshun Wan, Zhen-Hua Ling, Jia Pan, Jianqing Gao, Cong Liu |
| 2023 | ICASSP | Speech Reconstruction from Silent Tongue and Lip Articulation by Pseudo Target Generation and Domain Adversarial Training. | Rui-Chen Zheng, Yang Ai, Zhen-Hua Ling |
| 2023 | Interspeech | BASEN: Time-Domain Brain-Assisted Speech Enhancement Network with Convolutional Cross Attention in Multi-talker Conditions. | Jie Zhang, Qing-Tian Xu, Qiu-Shi Zhu, Zhen-Hua Ling |
| 2023 | Interspeech | Speech Synthesis with Self-Supervisedly Learnt Prosodic Representations. | Zhaoci Liu, Zhen-Hua Ling, Ya-Jun Hu, Jia Pan, Jin-Wei Wang, Yun-Di Wu |
| 2023 | Interspeech | MP-SENet: A Speech Enhancement Model with Parallel Denoising of Magnitude and Phase Spectra. | Ye-Xin Lu, Yang Ai, Zhen-Hua Ling |
| 2023 | Interspeech | Incorporating Ultrasound Tongue Images for Audio-Visual Speech Enhancement through Knowledge Distillation. | Rui-Chen Zheng, Yang Ai, Zhen-Hua Ling |
| 2022 | ACL | HeterMPC: A Heterogeneous Graph Neural Network for Response Generation in Multi-Party Conversations. | Jia-Chen Gu, Chao-Hong Tan, Chongyang Tao, Zhen-Hua Ling, Huang Hu, Xiubo Geng, Daxin Jiang |
| 2022 | ACL | TegTok: Augmenting Text Generation via Task-specific and Open-world Knowledge. | Chao-Hong Tan, Jia-Chen Gu, Chongyang Tao, Zhen-Hua Ling, Can Xu, Huang Hu, Xiubo Geng, Daxin Jiang |
| 2022 | ICASSP | Improving Recognition-Synthesis Based any-to-one Voice Conversion with Cyclic Training. | Yan-Nian Chen, Li-Juan Liu, Ya-Jun Hu, Yuan Jiang, Zhen-Hua Ling |
| 2022 | ICASSP | Neural Grapheme-To-Phoneme Conversion with Pre-Trained Grapheme Models. | Lu Dong, Zhiqiang Guo, Chao-Hong Tan, Ya-Jun Hu, Yuan Jiang, Zhen-Hua Ling |
| 2022 | ICASSP | Discourse-Level Prosody Modeling with a Variational Autoencoder for Non-Autoregressive Expressive Speech Synthesis. | Ning-Qian Wu, Zhaoci Liu, Zhen-Hua Ling |
| 2022 | ICLR | PoNet: Pooling Network for Efficient Token Mixing in Long Sequences. | Chao-Hong Tan, Qian Chen, Wen Wang, Qinglin Zhang, Siqi Zheng, Zhen-Hua Ling |
| 2022 | IJCAI | Who Says What to Whom: A Survey of Multi-Party Conversations. | Jia-Chen Gu, Chongyang Tao, Zhen-Hua Ling |
| 2022 | Interspeech | Pronunciation Dictionary-Free Multilingual Speech Synthesis by Combining Unsupervised and Supervised Phonetic Representations. | Chang Liu, Zhen-Hua Ling, Ling-Hui Chen |
| 2021 | AAAI | Tracking Interaction States for Multi-Turn Text-to-SQL Semantic Parsing. | Runze Wang, Zhen-Hua Ling, Jingbo Zhou, Yu Hu |
| 2021 | AAAI | TaLNet: Voice Reconstruction from Tongue and Lip Articulation with Transfer Learning from Text-to-Speech Synthesis. | Jing-Xuan Zhang, Korin Richmond, Zhen-Hua Ling, Lirong Dai |
| 2021 | ACL | MPC-BERT: A Pre-Trained Language Model for Multi-Party Conversation Understanding. | Jia-Chen Gu, Chongyang Tao, Zhen-Hua Ling, Can Xu, Xiubo Geng, Daxin Jiang |
| 2021 | EMNLP | Detecting Speaker Personas from Conversational Texts. | Jia-Chen Gu, Zhen-Hua Ling, Yu Wu, Quan Liu, Zhigang Chen, Xiaodan Zhu |
| 2021 | ICASSP | Have You Made a Decision? Where? A Pilot Study on Interpretability of Polarity Analysis Based on Advising Problem. | Tianda Li, Jia-Chen Gu, Hui Liu, Quan Liu, Zhen-Hua Ling, Zhiming Su, Xiaodan Zhu |
| 2021 | ICASSP | Graph Attention and Interaction Network With Multi-Task Learning for Fact Verification. | Rui Yang, Runze Wang, Zhen-Hua Ling |
| 2021 | Interspeech | A Neural-Network-Based Approach to Identifying Speakers in Novels. | Yue Chen, Zhen-Hua Ling, Qing-Feng Liu |
| 2021 | Interspeech | Adversarial Voice Conversion Against Neural Spoofing Detectors. | Yi-Yang Ding, Li-Juan Liu, Yu Hu, Zhen-Hua Ling |
| 2021 | Interspeech | UnitNet-Based Hybrid Speech Synthesis. | Xiao Zhou, Zhen-Hua Ling, Li-Rong Dai |
| 2021 | WCNC | Compressed Network in Network Models for Traffic Classification. | Min Lu, Bin Zhou, Zhiyong Bu, Kecheng Zhang, Zhen-Hua Ling |
| 2021 | SIGIR | Partner Matters! An Empirical Study on Fusing Personas for Personalized Response Selection in Retrieval-Based Chatbots. | Jia-Chen Gu, Hui Liu, Zhen-Hua Ling, Quan Liu, Zhigang Chen, Xiaodan Zhu |
| 2020 | CIKM | Speaker-Aware BERT for Multi-Turn Response Selection in Retrieval-Based Chatbots. | Jia-Chen Gu, Tianda Li, Quan Liu, Zhen-Hua Ling, Zhiming Su, Si Wei, Xiaodan Zhu |
| 2020 | EMNLP | Filtering before Iteratively Referring for Knowledge-Grounded Response Selection in Retrieval-Based Chatbots. | Jia-Chen Gu, Zhen-Hua Ling, Quan Liu, Zhigang Chen, Xiaodan Zhu |
| 2020 | ICASSP | WaveFFJORD: FFJORD-Based Vocoder for Statistical Parametric Speech Synthesis. | Ning-Qian Wu, Zhen-Hua Ling |
| 2020 | ICASSP | Extracting Unit Embeddings Using Sequence-To-Sequence Acoustic Models for Unit Selection Speech Synthesis. | Xiao Zhou, Zhen-Hua Ling, Li-Rong Dai |
| 2020 | Interspeech | Knowledge-and-Data-Driven Amplitude Spectrum Prediction for Hierarchical Neural Vocoders. | Yang Ai, Zhen-Hua Ling |
| 2020 | Interspeech | Reverberation Modeling for Source-Filter-Based Neural Vocoder. | Yang Ai, Xin Wang, Junichi Yamagishi, Zhen-Hua Ling |
| 2020 | Interspeech | Unsupervised Regularization-Based Adaptive Training for Speech Recognition. | Fenglin Ding, Wu Guo, Bin Gu, Zhen-Hua Ling, Jun Du |
| 2020 | Interspeech | Adaptive Speaker Normalization for CTC-Based Speech Recognition. | Fenglin Ding, Wu Guo, Bin Gu, Zhen-Hua Ling, Jun Du |
| 2020 | Interspeech | An Adaptive X-Vector Model for Text-Independent Speaker Verification. | Bin Gu, Wu Guo, Fenglin Ding, Zhen-Hua Ling, Jun Du |
| 2020 | Interspeech | Recognition-Synthesis Based Non-Parallel Voice Conversion with Adversarial Learning. | Jing-Xuan Zhang, Zhen-Hua Ling, Li-Rong Dai |
| 2019 | ACL | Multi-Level Matching and Aggregation Network for Few-Shot Relation Classification. | Zhi-Xiu Ye, Zhen-Hua Ling |
| 2019 | CIKM | Interactive Matching Network for Multi-Turn Response Selection in Retrieval-Based Chatbots. | Jia-Chen Gu, Zhen-Hua Ling, Quan Liu |
| 2019 | EMNLP | Dually Interactive Matching Network for Personalized Response Selection in Retrieval-Based Chatbots. | Jia-Chen Gu, Zhen-Hua Ling, Xiaodan Zhu, Quan Liu |
| 2019 | ICASSP | Dnn-based Spectral Enhancement for Neural Waveform Generators with Low-bit Quantization. | Yang Ai, Jing-Xuan Zhang, Liang Chen, Zhen-Hua Ling |
| 2019 | ICASSP | Channel Adversarial Training for Cross-channel Text-independent Speaker Recognition. | Xin Fang, Liang Zou, Jin Li, Lei Sun, Zhen-Hua Ling |
| 2019 | ICASSP | Condition-transforming Variational Autoencoder for Conversation Response Generation. | Yu-Ping Ruan, Zhen-Hua Ling, Quan Liu, Zhigang Chen, Nitin Indurkhya |
| 2019 | ICASSP | Improving Sequence-to-sequence Voice Conversion by Adding Text-supervision. | Jing-Xuan Zhang, Zhen-Hua Ling, Yuan Jiang, Li-Juan Liu, Chen Liang, Li-Rong Dai |
| 2019 | ICASSP | Learning Latent Representations for Style Control and Transfer in End-to-end Speech Synthesis. | Yajie Zhang, Shifeng Pan, Lei He, Zhen-Hua Ling |
| 2019 | Interspeech | Neural Text Clustering with Document-Level Attention Based on Dynamic Soft Labels. | Zhi Chen, Wu Guo, Li-Rong Dai, Zhen-Hua Ling, Jun Du |
| 2019 | Interspeech | A Chinese Dataset for Identifying Speakers in Novels. | Jia-Xiang Chen, Zhen-Hua Ling, Li-Rong Dai |
| 2019 | Interspeech | Singing Voice Synthesis Using Deep Autoregressive Neural Networks for Acoustic Modeling. | Yuan-Hao Yi, Yang Ai, Zhen-Hua Ling, Li-Rong Dai |
| 2019 | NAACL | Distant Supervision Relation Extraction with Intra-Bag and Inter-Bag Attentions. | Zhi-Xiu Ye, Zhen-Hua Ling |
| 2018 | ACL | Neural Natural Language Inference Models Enhanced with External Knowledge. | Qian Chen, Xiaodan Zhu, Zhen-Hua Ling, Diana Inkpen, Si Wei |
| 2018 | ACL | Hybrid semi-Markov CRF for Neural Sequence Labeling. | Zhi-Xiu Ye, Zhen-Hua Ling |
| 2018 | COLING | Enhancing Sentence Embedding with Generalized Pooling. | Qian Chen, Zhen-Hua Ling, Xiaodan Zhu |
| 2018 | ICASSP | Samplernn-Based Neural Vocoder for Statistical Parametric Speech Synthesis. | Yang Ai, Hong-Chuan Wu, Zhen-Hua Ling |
| 2018 | ICASSP | Forward Attention in Sequence- To-Sequence Acoustic Modeling for Speech Synthesis. | Jing-Xuan Zhang, Zhen-Hua Ling, Li-Rong Dai |
| 2018 | Interspeech | WaveNet Vocoder with Limited Training Data for Voice Conversion. | Li-Juan Liu, Zhen-Hua Ling, Yuan Jiang, Ming Zhou, Li-Rong Dai |
| 2018 | Interspeech | Learning and Modeling Unit Embeddings for Improving HMM-based Unit Selection Speech Synthesis. | Xiao Zhou, Zhen-Hua Ling, Zhi-Ping Zhou, Li-Rong Dai |
| 2017 | ACL | Enhanced LSTM for Natural Language Inference. | Qian Chen, Xiaodan Zhu, Zhen-Hua Ling, Si Wei, Hui Jiang, Diana Inkpen |
| 2017 | ASRU | The USTC system for blizzard machine learning challenge 2017-ES2. | Ya-Jun Hu, Li-Juan Liu, Chuang Ding, Zhen-Hua Ling, Li-Rong Dai |
| 2017 | ASRU | The iFLYTEK system for blizzard machine learning challenge 2017-ES1. | Li-Juan Liu, Chuang Ding, Ya-Jun Hu, Zhen-Hua Ling, Yuan Jiang, Ming Zhou, Si Wei |
| 2017 | ICASSP | Extracting structural spectral features using what-where auto-encoders for statistical parametric speech synthesis. | Ya-Jun Hu, Zhen-Hua Ling, Li-Rong Dai |
| 2017 | IJCAI | Cause-Effect Knowledge Acquisition and Neural Association Model for Solving A Set of Winograd Schema Problems. | Quan Liu, Hui Jiang, Andrew Evdokimov, Zhen-Hua Ling, Xiaodan Zhu, Si Wei, Yu Hu |
| 2017 | Interspeech | Waveform Modeling Using Stacked Dilated Convolutional Neural Networks for Speech Bandwidth Extension. | Yu Gu, Zhen-Hua Ling |
| 2016 | EMNLP | Exploring Semantic Representation in Brain Activity Using Word Embeddings. | Yu-Ping Ruan, Zhen-Hua Ling, Yu Hu |
| 2016 | ICASSP | Deep belief network-based post-filtering for statistical parametric speech synthesis. | Ya-Jun Hu, Zhen-Hua Ling, Li-Rong Dai |
| 2016 | ICASSP | Modulation spectrum compensation for HMM-based speech synthesis using line spectral pairs. | Zhen-Hua Ling, Xiao-Hui Sun, Li-Rong Dai, Yu Hu |
| 2016 | ICASSP | A full training framework of cross-stream dependence modelling for HMM-based singing voice synthesis. | Xin Wang, Minghui Dong, Zhen-Hua Ling |
| 2016 | ICASSP | Modeling spectral envelopes using deep conditional restricted Boltzmann machines for statistical parametric speech synthesis. | Xiang Yin, Zhen-Hua Ling, Ya-Jun Hu, Li-Rong Dai |
| 2016 | IJCAI | Distraction-Based Neural Networks for Modeling Document. | Qian Chen, Xiaodan Zhu, Zhen-Hua Ling, Si Wei, Hui Jiang |
| 2016 | Interspeech | The USTC System for Voice Conversion Challenge 2016: Neural Network Based Approaches for Spectrum, Aperiodicity and F | Ling-Hui Chen, Li-Juan Liu, Zhen-Hua Ling, Yuan Jiang, Li-Rong Dai |
| 2016 | Interspeech | Speech Bandwidth Extension Using Bottleneck Features and Deep Recurrent Neural Networks. | Yu Gu, Zhen-Hua Ling, Li-Rong Dai |
| 2016 | Interspeech | Articulatory-to-Acoustic Conversion with Cascaded Prediction of Spectral and Excitation Features Using Neural Networks. | Zheng-Chen Liu, Zhen-Hua Ling, Li-Rong Dai |
| 2016 | NAACL | Intra-Topic Variability Normalization based on Linear Projection for Topic Classification. | Quan Liu, Wu Guo, Zhen-Hua Ling, Hui Jiang, Yu Hu |
| 2015 | ACL | Learning Semantic Word Embeddings based on Ordinal Knowledge Constraints. | Quan Liu, Hui Jiang, Si Wei, Zhen-Hua Ling, Yu Hu |
| 2015 | ICASSP | Spectral conversion using deep neural networks trained with multi-source speakers. | Li-Juan Liu, Ling-Hui Chen, Zhen-Hua Ling, Li-Rong Dai |
| 2015 | IJCNN | Restoring high frequency spectral envelopes using neural networks for speech bandwidth extension. | Yu Gu, Zhen-Hua Ling |
| 2015 | Interspeech | Automatic phrase boundary labeling of speech synthesis database using context-dependent HMMs and n-gram prior distributions. | Qian Chen, Zhen-Hua Ling, Chen-Yu Yang, Li-Rong Dai |
| 2014 | ICASSP | Using bidirectional associative memories for joint spectral envelope modeling in voice conversion. | Li-Juan Liu, Ling-Hui Chen, Zhen-Hua Ling, Li-Rong Dai |
| 2014 | ICASSP | Spectral modeling using neural autoregressive distribution estimators for statistical parametric speech synthesis. | Xiang Yin, Zhen-Hua Ling, Li-Rong Dai |
| 2014 | Interspeech | Formant-controlled speech synthesis using hidden trajectory model. | Ming-Qi Cai, Zhen-Hua Ling, Li-Rong Dai |
| 2014 | Interspeech | Voice conversion using generative trained deep neural networks with multiple frame spectral envelopes. | Ling-Hui Chen, Zhen-Hua Ling, Li-Rong Dai |
| 2014 | Interspeech | DNN-based stochastic postfilter for HMM-based speech synthesis. | Ling-Hui Chen, Tuomo Raitio, Cassia Valentini-Botinhao, Junichi Yamagishi, Zhen-Hua Ling |
| 2014 | Interspeech | Concept-to-speech generation by integrating syntagmatic features into HMM-based speech synthesis. | Xin Wang, Zhen-Hua Ling, Li-Rong Dai |
| 2014 | Interspeech | Modeling DCT parameterized F0 trajectory at intonation phrase level with DNN or decision tree. | Xiang Yin, Ming Lei, Yao Qian, Frank K. Soong, Lei He, Zhen-Hua Ling, Li-Rong Dai |
| 2013 | ICASSP | Modeling spectral envelopes using restricted Boltzmann machines for statistical parametric speech synthesis. | Zhen-Hua Ling, Li Deng, Dong Yu |
| 2013 | ICASSP | Unsupervised prosodic phrase boundary labeling of Mandarin speech synthesis database using context-dependent HMM. | Chen-Yu Yang, Zhen-Hua Ling, Li-Rong Dai |
| 2013 | Interspeech | Joint spectral distribution modeling using restricted boltzmann machines for voice conversion. | Ling-Hui Chen, Zhen-Hua Ling, Yan Song, Li-Rong Dai |
| 2013 | Interspeech | On the evaluation of inversion mapping performance in the acoustic domain. | Korin Richmond, Zhen-Hua Ling, Junichi Yamagishi, Benigno Uria |
| 2012 | Interspeech | Vowel Creation by Articulatory Control in HMM-based Parametric Speech Synthesis. | Zhen-Hua Ling, Korin Richmond, Junichi Yamagishi |
| 2012 | Interspeech | Considering Global Variance of the Log Power Spectrum Derived from Mel-Cepstrum in HMM-based Parametric Speech Synthesis. | Xiang Yin, Zhen-Hua Ling, Ming Lei, Li-Rong Dai |
| 2011 | ICASSP | Non-parallel training for voice conversion based on FT-GMM. | Ling-Hui Chen, Zhen-Hua Ling, Li-Rong Dai |
| 2011 | ICASSP | Preserve ordering property of generated LSPS for minimum generation error training in HMM-based speech synthesis. | Ming Lei, Zhen-Hua Ling, Li-Rong Dai |
| 2011 | ICASSP | Building HMM based unit-selection speech synthesis system using synthetic speech naturalness evaluation score. | Heng Lu, Zhen-Hua Ling, Li-Rong Dai, Ren-Hua Wang |
| 2011 | Interspeech | Estimation of Window Coefficients for Dynamic Feature Extraction for HMM-Based Speech Synthesis. | Ling-Hui Chen, Yoshihiko Nankaku, Heiga Zen, Keiichi Tokuda, Zhen-Hua Ling, Li-Rong Dai |
| 2011 | Interspeech | Formant-Controlled HMM-Based Speech Synthesis. | Ming Lei, Junichi Yamagishi, Korin Richmond, Zhen-Hua Ling, Simon King, Li-Rong Dai |
| 2011 | Interspeech | Feature-Space Transform Tying in Unified Acoustic-Articulatory Modelling for Articulatory Control of HMM-Based Speech Synthesis. | Zhen-Hua Ling, Korin Richmond, Junichi Yamagishi |
| 2010 | ICASSP | Minimum generation error training with weighted Euclidean distance on LSP for HMM-based speech synthesis. | Ming Lei, Zhen-Hua Ling, Li-Rong Dai |
| 2010 | Interspeech | A hierarchical F0 modeling method for HMM-based speech synthesis. | Ming Lei, Yi-Jian Wu, Frank K. Soong, Zhen-Hua Ling, Li-Rong Dai |
| 2010 | Interspeech | Global variance modeling on the log power spectrum of LSPs for HMM-based speech synthesis. | Zhen-Hua Ling, Yu Hu, Li-Rong Dai |
| 2010 | Interspeech | HMM-based text-to-articulatory-movement prediction and analysis of critical articulators. | Zhen-Hua Ling, Korin Richmond, Junichi Yamagishi |
| 2010 | Interspeech | Automatic error detection for unit selection speech synthesis using log likelihood ratio based SVM classifier. | Heng Lu, Zhen-Hua Ling, Si Wei, Li-Rong Dai, Ren-Hua Wang |
| 2009 | Interspeech | Asynchronous F0 and spectrum modeling for HMM-based speech synthesis. | Cheng-Cheng Wang, Zhen-Hua Ling, Li-Rong Dai |
| 2008 | ICASSP | Minimum unit selection error training for HMM-based unit selection speech synthesis system. | Zhen-Hua Ling, Ren-Hua Wang |
| 2008 | ICASSP | Minumum generation error linear regression based model adaptation for HMM-based speech synthesis. | Long Qin, Yi-Jian Wu, Zhen-Hua Ling, Ren-Hua Wang, Li-Rong Dai |
| 2008 | ICASSP | Minimum generation error criterion considering global/local variance for HMM-based speech synthesis. | Long Qin, Yi-Jian Wu, Zhen-Hua Ling, Ren-Hua Wang, Li-Rong Dai |
| 2008 | Interspeech | Articulatory control of HMM-based parametric speech synthesis driven by phonetic knowledge. | Zhen-Hua Ling, Korin Richmond, Junichi Yamagishi, Ren-Hua Wang |
| 2008 | Interspeech | Robustness of HMM-based speech synthesis. | Junichi Yamagishi, Zhen-Hua Ling, Simon King |
| 2008 | ISM | Model Adaptation for HMM-Based Speech Synthesis under Minimum Generation Error Criterion. | Long Qin, Yi-Jian Wu, Zhen-Hua Ling, Ren-Hua Wang |
| 2007 | ICASSP | HMM-Based Hierarchical Unit Selection Combining Kullback-Leibler Divergence with Likelihood Criterion. | Zhen-Hua Ling, Ren-Hua Wang |
| 2006 | Interspeech | HMM-based unit selection using frame sized speech segments. | Zhen-Hua Ling, Ren-Hua Wang |
| 2006 | Interspeech | Improving the performance of HMM-based voice conversion using context clustering decision tree and appropriate regression matrix format. | Long Qin, Yi-Jian Wu, Zhen-Hua Ling, Ren-Hua Wang |
| 2005 | ACII | A Novel Source Analysis Method by Matching Spectral Characters of LF Model with STRAIGHT Spectrum. | Zhen-Hua Ling, Yu Hu, Ren-Hua Wang |
| 2005 | ACII | Emotional Speech Synthesis Based on Improved Codebook Mapping Voice Conversion. | Yu-Ping Wang, Zhen-Hua Ling, Ren-Hua Wang |
| 2005 | ICASSP | An Improved Spectral and Prosodic Transformation Method in STRAIGHT-based Voice Conversion. | Long Qin, Gao Peng Chen, Zhen-Hua Ling, Li-Rong Dai |
| 2004 | Interspeech | Compression of speech database by feature separation and pattern clustering using STRAIGHT. | Zhen-Hua Ling, Yu Hu, Zhiwei Shuang, Ren-Hua Wang |
| 2004 | Interspeech | A novel voice conversion system based on codebook mapping with phoneme-tied weighting. | Zixiang Wang, Ren-Hua Wang, Zhiwei Shuang, Zhen-Hua Ling |
| 2002 | Interspeech | A miniature Chinese TTS system based on tailored corpus. | Zhiwei Shuang, Yu Hu, Zhen-Hua Ling, Ren-Hua Wang |