| 2026 | AAAI | AStar: Boosting Multimodal Reasoning with Automated Structured Thinking. | Jinyang Wu, Mingkuan Feng, Guocheng Zhai, Shuai Zhang, Zheng Lian, Fangrui Lv, Pengpeng Shao, Ruihan Jin, Zhengqi Wen, Jianhua Tao |
| 2026 | AAAI | PSA-MF: Personality-Sentiment Aligned Multi-Level Fusion for Multimodal Sentiment Analysis. | Heng Xie, Kang Zhu, Zhengqi Wen, Jianhua Tao, Xuefei Liu, Ruibo Fu, Changsheng Li |
| 2026 | ACL | ReFL: Reflective Feedback Learning for Hallucination Detection of Large Language Models. | Cunhang Fan, Jun Zhang, Xue Zhang, Shuai Zhang, Zhao Lv, Jianhua Tao, Zhengqi Wen |
| 2026 | ACL | Two-Stage Regularization-Based Structured Pruning for LLMs. | Mingkuan Feng, Jinyang Wu, Siyuan Liu, Shuai Zhang, Hongjian Fang, Ruihan Jin, Feihu Che, Pengpeng Shao, Zhengqi Wen, Jianhua Tao |
| 2026 | ACL | Beyond Examples: Towards Automated Thought-level In-Context Reasoning for Large Language Models. | Jinyang Wu, Mingkuan Feng, Shuai Zhang, Feihu Che, Zhengqi Wen, Chonghua Liao, Ling Yang, Haoran Luo, Zheng Lian, Jianhua Tao |
| 2026 | ACL | TemplateRL: Structured Template-Guided Reinforcement Learning for LLM Reasoning. | Jinyang Wu, Chonghua Liao, Mingkuan Feng, Shuai Zhang, Zhengqi Wen, Haoran Luo, Ling Yang, Huazhe Xu, Jianhua Tao |
| 2026 | ACL | SPARK: Strategic Policy-Aware Exploration via Dynamic Branching for Long-Horizon Agentic Learning. | Jinyang Wu, Shuo Yang, Yuhao Shen, Shuai Zhang, Zhengqi Wen, Jianhua Tao |
| 2026 | ACL | ATLAS: Orchestrating Heterogeneous Models and Tools for Multi-Domain Complex Reasoning. | Jinyang Wu, Guocheng Zhai, Ruihan Jin, Jiahao Yuan, Yuhao Shen, Shuai Zhang, Zhengqi Wen, Jianhua Tao |
| 2026 | ACL | CAIR: Causal Adaptive Information-based Reinforcement Learning for Multimodal Emotion Reasoning. | Fengyu Zhang, Bin Liu, Jianhua Tao, Zhuofan Wen, Shun Chen, Hailiang Yao, Zhengqi Wen |
| 2025 | AAAI | Code-switching Mediated Sentence-level Semantic Learning. | Shuai Zhang, Jiangyan Yi, Zhengqi Wen, Jianhua Tao, Feihu Che, Jinyang Wu, Ruibo Fu |
| 2025 | AAAI | Region-Based Optimization in Continual Learning for Audio Deepfake Detection. | Yujie Chen, Jiangyan Yi, Cunhang Fan, Jianhua Tao, Yong Ren, Siding Zeng, Chu Yuan Zhang, Xinrui Yan, Hao Gu, Jun Xue, Chenglong Wang, Zhao Lv, Xiaohui Zhang |
| 2025 | AAAI | BSDB-Net: Band-Split Dual-Branch Network with Selective State Spaces Mechanism for Monaural Speech Enhancement. | Cunhang Fan, Enrui Liu, Andong Li, Jianhua Tao, Jian Zhou, Jiahao Li, Chengshi Zheng, Zhao Lv |
| 2025 | ACL | Listen, Watch, and Learn to Feel: Retrieval-Augmented Emotion Reasoning for Compound Emotion Generation. | Zhuofan Wen, Zheng Lian, Shun Chen, Hailiang Yao, Longjiang Yang, Bin Liu, Jianhua Tao |
| 2025 | ACL | Pandora's Box or Aladdin's Lamp: A Comprehensive Analysis Revealing the Role of RAG Noise in Large Language Models. | Jinyang Wu, Shuai Zhang, Feihu Che, Mingkuan Feng, Pengpeng Shao, Jianhua Tao |
| 2025 | CVPR | ImViD: Immersive Volumetric Videos for Enhanced VR Engagement. | Zhengxian Yang, Shi Pan, Shengqi Wang, Haoxiang Wang, Li Lin, Guanjun Li, Zhengqi Wen, Borong Lin, Jianhua Tao, Tao Yu |
| 2025 | EMNLP | RadialRouter: Structured Representation for Efficient and Robust Large Language Models Routing. | Ruihan Jin, Pengpeng Shao, Zhengqi Wen, Jinyang Wu, Mingkuan Feng, Shuai Zhang, Jianhua Tao |
| 2025 | ICASSP | PET: High-Frequency Temporal Self-Consistency Learning for Partially Deepfake Audio Localization. | Jiayi He, Jiangyan Yi, Jianhua Tao, Siding Zeng |
| 2025 | ICASSP | DPI-TTS: Directional Patch Interaction for Fast-Converging and Style Temporal Modeling in Text-to-Speech. | Xin Qi, Ruibo Fu, Zhengqi Wen, Tao Wang, Chunyu Qiang, Jianhua Tao, Chenxing Li, Yi Lu, Shuchen Shi, Zhiyong Wang, Xiaopeng Wang, Yuankun Xie, Yukun Liu, Xuefei Liu, Guanjun Li |
| 2025 | ICASSP | Mixture of Experts Fusion for Fake Audio Detection Using Frozen wav2vec 2.0. | Zhiyong Wang, Ruibo Fu, Zhengqi Wen, Jianhua Tao, Xiaopeng Wang, Yuankun Xie, Xin Qi, Shuchen Shi, Yi Lu, Yukun Liu, Chenxing Li, Xuefei Liu, Guanjun Li |
| 2025 | ICASSP | MTPareto: A MultiModal Targeted Pareto Framework for Fake News Detection. | Kaiying Yan, Moyang Liu, Yukun Liu, Ruibo Fu, Zhengqi Wen, Jianhua Tao, Xuefei Liu, Guanjun Li |
| 2025 | ICASSP | Adversarial Training and Gradient Optimization for Partially Deepfake Audio Localization. | Siding Zeng, Jiangyan Yi, Jianhua Tao, Jiayi He, Zheng Lian, Shan Liang, Chuyuan Zhang, Yujie Chen, Xiaohui Zhang |
| 2025 | ICASSP | WMCodec: End-to-End Neural Speech Codec with Deep Watermarking for Authenticity Verification. | Junzuo Zhou, Jiangyan Yi, Yong Ren, Jianhua Tao, Tao Wang, Chuyuan Zhang |
| 2025 | ICML | AffectGPT: A New Dataset, Model, and Benchmark for Emotion Understanding with Multimodal Large Language Models. | Zheng Lian, Haoyu Chen, Lan Chen, Haiyang Sun, Licai Sun, Yong Ren, Zebang Cheng, Bin Liu, Rui Liu, Xiaojiang Peng, Jiangyan Yi, Jianhua Tao |
| 2025 | ICML | OV-MER: Towards Open-Vocabulary Multimodal Emotion Recognition. | Zheng Lian, Haiyang Sun, Licai Sun, Haoyu Chen, Lan Chen, Hao Gu, Zhuofan Wen, Shun Chen, Siyuan Zhang, Hailiang Yao, Bin Liu, Rui Liu, Shan Liang, Ya Li, Jiangyan Yi, Jianhua Tao |
| 2024 | AAAI | Progressive Distillation Based on Masked Generation Feature Method for Knowledge Graph Completion. | Cunhang Fan, Yujie Chen, Jun Xue, Yonghui Kong, Jianhua Tao, Zhao Lv |
| 2024 | AAAI | What to Remember: Self-Adaptive Continual Learning for Audio Deepfake Detection. | Xiaohui Zhang, Jiangyan Yi, Chenglong Wang, Chu Yuan Zhang, Siding Zeng, Jianhua Tao |
| 2024 | COLING | NLoPT: N-gram Enhanced Low-Rank Task Adaptive Pre-training for Efficient Language Model Adaption. | Hao Gu, Jiangyan Yi, Zheng Lian, Jianhua Tao, Xinrui Yan |
| 2024 | ICANN | Multi-stage Vs Single-Stage: A Local Information Focused Approach for Overlapping Event Extraction. | Shuaihu Han, Guohua Yang, Dawei Zhang, Jianhua Tao, Feihu Che |
| 2024 | ICASSP | Fewer-Token Neural Speech Codec with Time-Invariant Codes. | Yong Ren, Tao Wang, Jiangyan Yi, Le Xu, Jianhua Tao, Chu Yuan Zhang, Junzuo Zhou |
| 2024 | ICASSP | Multi-Scale Permutation Entropy for Audio Deepfake Detection. | Chenglong Wang, Jiayi He, Jiangyan Yi, Jianhua Tao, Chu Yuan Zhang, Xiaohui Zhang |
| 2024 | ICASSP | Pseudo Labels Regularization for Imbalanced Partial-Label Learning. | Mingyu Xu, Zheng Lian, Bin Liu, Zerui Chen, Jianhua Tao |
| 2024 | IJCNN | What Comes Next and Why? A Staged Encoder-Decoder Architecture for Script Event Prediction. | Shuaihu Han, Guohua Yang, Dawei Zhang, Jianhua Tao |
| 2024 | IJCNN | APC: Predict Global Representation From Local Observation In Multi-Agent Reinforcement Learning. | Xiaoyang Li, Guohua Yang, Dawei Zhang, Jianhua Tao |
| 2024 | Interspeech | RawBMamba: End-to-End Bidirectional State Space Model for Audio Deepfake Detection. | Yujie Chen, Jiangyan Yi, Jun Xue, Chenglong Wang, Xiaohui Zhang, Shunbo Dong, Siding Zeng, Jianhua Tao, Zhao Lv, Cunhang Fan |
| 2024 | Interspeech | Codecfake: An Initial Dataset for Detecting LLM-based Deepfake Audio. | Yi Lu, Yuankun Xie, Ruibo Fu, Zhengqi Wen, Jianhua Tao, Zhiyong Wang, Xin Qi, Xuefei Liu, Yongwei Li, Yukun Liu, Xiaopeng Wang, Shuchen Shi |
| 2024 | Interspeech | PPPR: Portable Plug-in Prompt Refiner for Text to Audio Generation. | Shuchen Shi, Ruibo Fu, Zhengqi Wen, Jianhua Tao, Tao Wang, Chunyu Qiang, Yi Lu, Xin Qi, Xuefei Liu, Yukun Liu, Yongwei Li, Zhiyong Wang, Xiaopeng Wang |
| 2024 | Interspeech | Genuine-Focused Learning using Mask AutoEncoder for Generalized Fake Audio Detection. | Xiaopeng Wang, Ruibo Fu, Zhengqi Wen, Zhiyong Wang, Yuankun Xie, Yukun Liu, Jianhua Tao, Xuefei Liu, Yongwei Li, Xin Qi, Yi Lu, Shuchen Shi |
| 2024 | Interspeech | Generalized Fake Audio Detection via Deep Stable Learning. | Zhiyong Wang, Ruibo Fu, Zhengqi Wen, Yuankun Xie, Yukun Liu, Xiaopeng Wang, Xuefei Liu, Yongwei Li, Jianhua Tao, Xin Qi, Yi Lu, Shuchen Shi |
| 2024 | Interspeech | Generalized Source Tracing: Detecting Novel Audio Deepfake Algorithm with Real Emphasis and Fake Dispersion Strategy. | Yuankun Xie, Ruibo Fu, Zhengqi Wen, Zhiyong Wang, Xiaopeng Wang, Haonan Cheng, Long Ye, Jianhua Tao |
| 2024 | Interspeech | Residual Speaker Representation for One-Shot Voice Conversion. | Le Xu, Jiangyan Yi, Tao Wang, Yong Ren, Rongxiu Zhong, Zhengqi Wen, Jianhua Tao |
| 2024 | Interspeech | TraceableSpeech: Towards Proactively Traceable Text-to-Speech with Watermarking. | Junzuo Zhou, Jiangyan Yi, Tao Wang, Jianhua Tao, Ye Bai, Chu Yuan Zhang, Yong Ren, Zhengqi Wen |
| 2024 | Interspeech | Prompt Link Multimodal Fusion in Multimodal Sentiment Analysis. | Kang Zhu, Cunhang Fan, Jianhua Tao, Zhao Lv |
| 2024 | NAACL | Bilateral Masking with prompt for Knowledge Graph Completion. | Yonghui Kong, Cunhang Fan, Yujie Chen, Shuai Zhang, Zhao Lv, Jianhua Tao |
| 2023 | ICASSP | GCC-Speaker: Target Speaker Localization with Optimal Speaker-Dependent Weighting in Multi-Speaker Scenarios. | Guanjun Li, Wei Xue, Wenju Liu, Jiangyan Yi, Jianhua Tao |
| 2023 | ICASSP | M | Jinlong Xue, Yayue Deng, Fengping Wang, Ya Li, Yingming Gao, Jianhua Tao, Jianqing Sun, Jiaen Liang |
| 2023 | ICML | Do You Remember? Overcoming Catastrophic Forgetting for Fake Audio Detection. | Xiaohui Zhang, Jiangyan Yi, Jianhua Tao, Chenglong Wang, Chu Yuan Zhang |
| 2023 | ICONIP | Learning Item Attributes and User Interests for Knowledge Graph Enhanced Recommendation. | Zepeng Huai, Guohua Yang, Jianhua Tao, Dawei Zhang |
| 2023 | Interspeech | EmotionNAS: Two-stream Neural Architecture Search for Speech Emotion Recognition. | Haiyang Sun, Zheng Lian, Bin Liu, Ying Li, Jianhua Tao, Licai Sun, Cong Cai, Meng Wang, Yuan Cheng |
| 2023 | Interspeech | Detection of Cross-Dataset Fake Audio Based on Prosodic and Pronunciation Features. | Chenglong Wang, Jiangyan Yi, Jianhua Tao, Chu Yuan Zhang, Shuai Zhang, Xun Chen |
| 2023 | Interspeech | TO-Rawnet: Improving RawNet with TCN and Orthogonal Regularization for Fake Audio Detection. | Chenglong Wang, Jiangyan Yi, Jianhua Tao, Chu Yuan Zhang, Shuai Zhang, Ruibo Fu, Xun Chen |
| 2023 | Interspeech | SOT: Self-supervised Learning-Assisted Optimal Transport for Unsupervised Adaptive Speech Emotion Recognition. | Ruiteng Zhang, Jianguo Wei, Xugang Lu, Yongwei Li, Junhai Xu, Di Jin, Jianhua Tao |
| 2022 | ECCV | Two-Aspect Information Interaction Model for ABAW4 Multi-task Challenge. | Haiyang Sun, Zheng Lian, Bin Liu, Jianhua Tao, Licai Sun, Cong Cai, Yu He |
| 2022 | ICASSP | End-to-End Network Based on Transformer for Automatic Detection of Covid-19. | Cong Cai, Bin Liu, Jianhua Tao, Zhengkun Tian, Jiahao Lu, Kexin Wang |
| 2022 | ICASSP | Automatic Depression Level Assessment from Speech By Long-Term Global Information Embedding. | Ya Li, Mingyue Niu, Ziping Zhao, Jianhua Tao |
| 2022 | ICASSP | Context-Aware Mask Prediction Network for End-to-End Text-Based Speech Editing. | Tao Wang, Jiangyan Yi, Liqun Deng, Ruibo Fu, Jianhua Tao, Zhengqi Wen |
| 2022 | ICASSP | ADD 2022: the first Audio Deep Synthesis Detection Challenge. | Jiangyan Yi, Ruibo Fu, Jianhua Tao, Shuai Nie, Haoxin Ma, Chenglong Wang, Tao Wang, Zhengkun Tian, Ye Bai, Cunhang Fan, Shan Liang, Shiming Wang, Shuai Zhang, Xinrui Yan, Le Xu, Zhengqi Wen, Haizhou Li |
| 2022 | Interspeech | reducing multilingual context confusion for end-to-end code-switching automatic speech recognition. | Shuai Zhang, Jiangyan Yi, Zhengkun Tian, Jianhua Tao, Yu Ting Yeung, Liqun Deng |
| 2022 | Interspeech | Speaker recognition-assisted robust audio deepfake detection. | Jiahui Pan, Shuai Nie, Hui Zhang, Shulin He, Kanghao Zhang, Shan Liang, Xueliang Zhang, Jianhua Tao |
| 2021 | ICASSP | Decoupling Pronunciation and Language for End-to-End Code-Switching Automatic Speech Recognition. | Shuai Zhang, Jiangyan Yi, Zhengkun Tian, Ye Bai, Jianhua Tao, Zhengqi Wen |
| 2021 | ICASSP | Bi-Level Style and Prosody Decoupling Modeling for Personalized End-to-End Speech Synthesis. | Ruibo Fu, Jianhua Tao, Zhengqi Wen, Jiangyan Yi, Tao Wang, Chunyu Qiang |
| 2021 | ICASSP | Multi-Scale and Multi-Region Facial Discriminative Representation for Automatic Depression Level Prediction. | Mingyue Niu, Jianhua Tao, Bin Liu |
| 2021 | ICASSP | Multimodal Cross- and Self-Attention Network for Speech Emotion Recognition. | Licai Sun, Bin Liu, Jianhua Tao, Zheng Lian |
| 2021 | ICASSP | Prosody and Voice Factorization for Few-Shot Speaker Adaptation in the Challenge M2voc 2021. | Tao Wang, Ruibo Fu, Jiangyan Yi, Jianhua Tao, Zhengqi Wen, Chunyu Qiang, Shiming Wang |
| 2021 | ICASSP | Patnet : A Phoneme-Level Autoregressive Transformer Network for Speech Synthesis. | Shiming Wang, Zhenhua Ling, Ruibo Fu, Jiangyan Yi, Jianhua Tao |
| 2021 | ICMI | ASMMC21: The 6th International Workshop on Affective Social Multimedia Computing. | Dongyan Huang, Bjrn W. Schuller, Jianhua Tao, Lei Xie, Jie Yang |
| 2021 | ICMI | Facial Micro-Expression Recognition Based on Multi-Scale Temporal and Spatial Features. | Hao Zhang, Bin Liu, Jianhua Tao, Zhao Lv |
| 2021 | Interspeech | End-to-End Spelling Correction Conditioned on Acoustic Feature for Code-Switching Speech Recognition. | Shuai Zhang, Jiangyan Yi, Zhengkun Tian, Ye Bai, Jianhua Tao, Xuefei Liu, Zhengqi Wen |
| 2021 | Interspeech | TDCA-Net: Time-Domain Channel Attention Network for Depression Detection. | Cong Cai, Mingyue Niu, Bin Liu, Jianhua Tao, Xuefei Liu |
| 2021 | Interspeech | Continual Learning for Fake Audio Detection. | Haoxin Ma, Jiangyan Yi, Jianhua Tao, Ye Bai, Zhengkun Tian, Chenglong Wang |
| 2021 | Interspeech | FSR: Accelerating the Inference Process of Transducer-Based Models by Applying Fast-Skip Regularization. | Zhengkun Tian, Jiangyan Yi, Ye Bai, Jianhua Tao, Shuai Zhang, Zhengqi Wen |
| 2021 | Interspeech | Half-Truth: A Partially Fake Audio Detection Dataset. | Jiangyan Yi, Ye Bai, Jianhua Tao, Haoxin Ma, Zhengkun Tian, Chenglong Wang, Tao Wang, Ruibo Fu |
| 2020 | AAAI | ParamE: Regarding Neural Network Parameters as Relation Embeddings for Knowledge Graph Completion. | Feihu Che, Dawei Zhang, Jianhua Tao, Mingyue Niu, Bocheng Zhao |
| 2020 | ICASSP | Focusing on Attention: Prosody Transfer and Adaptative Optimization Strategy for Multi-Speaker End-to-End Speech Synthesis. | Ruibo Fu, Jianhua Tao, Zhengqi Wen, Jiangyan Yi, Tao Wang |
| 2020 | ICASSP | Multimodal Transformer Fusion for Continuous Emotion Recognition. | Jian Huang, Jianhua Tao, Bin Liu, Zheng Lian, Mingyue Niu |
| 2020 | ICASSP | Synchronous Transformers for end-to-end Speech Recognition. | Zhengkun Tian, Jiangyan Yi, Ye Bai, Jianhua Tao, Shuai Zhang, Zhengqi Wen |
| 2020 | Interspeech | Listen Attentively, and Spell Once: Whole Sentence Generation via a Non-Autoregressive Architecture for Low-Latency Speech Recognition. | Ye Bai, Jiangyan Yi, Jianhua Tao, Zhengkun Tian, Zhengqi Wen, Shuai Zhang |
| 2020 | Interspeech | Gated Recurrent Fusion of Spatial and Spectral Features for Multi-Channel Speech Separation with Deep Embedding Representations. | Cunhang Fan, Jianhua Tao, Bin Liu, Jiangyan Yi, Zhengqi Wen |
| 2020 | Interspeech | Joint Training for Simultaneous Speech Denoising and Dereverberation with Deep Embedding Representations. | Cunhang Fan, Jianhua Tao, Bin Liu, Jiangyan Yi, Zhengqi Wen |
| 2020 | Interspeech | Dynamic Soft Windowing and Language Dependent Style Token for Code-Switching End-to-End Speech Synthesis. | Ruibo Fu, Jianhua Tao, Zhengqi Wen, Jiangyan Yi, Chunyu Qiang, Tao Wang |
| 2020 | Interspeech | Dynamic Speaker Representations Adjustment and Decoder Factorization for Speaker Adaptation in End-to-End Speech Synthesis. | Ruibo Fu, Jianhua Tao, Zhengqi Wen, Jiangyan Yi, Tao Wang, Chunyu Qiang |
| 2020 | Interspeech | Learning Utterance-Level Representations with Label Smoothing for Speech Emotion Recognition. | Jian Huang, Jianhua Tao, Bin Liu, Zheng Lian |
| 2020 | Interspeech | Context-Dependent Domain Adversarial Neural Network for Multimodal Emotion Recognition. | Zheng Lian, Jianhua Tao, Bin Liu, Jian Huang, Zhanlei Yang, Rongjun Li |
| 2020 | Interspeech | Conversational Emotion Recognition Using Self-Attention Mechanisms and Graph Neural Networks. | Zheng Lian, Jianhua Tao, Bin Liu, Jian Huang, Zhanlei Yang, Rongjun Li |
| 2020 | Interspeech | ARVC: An Auto-Regressive Voice Conversion System Without Parallel Training Data. | Zheng Lian, Zhengqi Wen, Xinyong Zhou, Songbai Pu, Shengkai Zhang, Jianhua Tao |
| 2020 | Interspeech | Comparison of Glottal Source Parameter Values in Emotional Vowels. | Yongwei Li, Jianhua Tao, Bin Liu, Donna Erickson, Masato Akagi |
| 2020 | Interspeech | Spike-Triggered Non-Autoregressive Transformer for End-to-End Speech Recognition. | Zhengkun Tian, Jiangyan Yi, Jianhua Tao, Ye Bai, Shuai Zhang, Zhengqi Wen |
| 2020 | Interspeech | Non-Autoregressive End-to-End TTS with Coarse-to-Fine Decoding. | Tao Wang, Xuefei Liu, Jianhua Tao, Jiangyan Yi, Ruibo Fu, Zhengqi Wen |
| 2020 | Interspeech | Bi-Level Speaker Supervision for One-Shot Speech Synthesis. | Tao Wang, Jianhua Tao, Ruibo Fu, Jiangyan Yi, Zhengqi Wen, Chunyu Qiang |
| 2020 | Interspeech | Spoken Content and Voice Factorization for Few-Shot Speaker Adaptation. | Tao Wang, Jianhua Tao, Ruibo Fu, Jiangyan Yi, Zhengqi Wen, Rongxiu Zhong |
| 2020 | Interspeech | Focal Loss for Punctuation Prediction. | Jiangyan Yi, Jianhua Tao, Zhengkun Tian, Ye Bai, Cunhang Fan |
| 2020 | Interspeech | Hybrid Network Feature Extraction for Depression Assessment from Speech. | Ziping Zhao, Qifei Li, Nicholas Cummins, Bin Liu, Haishuai Wang, Jianhua Tao, Bjrn W. Schuller |
| 2019 | ACII | Efficient Modeling of Long Temporal Contexts for Continuous Emotion Recognition. | Jian Huang, Jianhua Tao, Bin Liu, Zhen Lian, Mingyue Niu |
| 2019 | ACII | Local Second-Order Gradient Cross Pattern for Automatic Depression Detection. | Mingyue Niu, Jianhua Tao, Bin Liu |
| 2019 | ICASSP | Phoneme Dependent Speaker Embedding and Model Factorization for Multi-speaker Speech Synthesis and Adaptation. | Ruibo Fu, Jianhua Tao, Zhengqi Wen, Yibin Zheng |
| 2019 | ICASSP | Discriminative Video Representation with Temporal Order for Micro-expression Recognition. | Mingyue Niu, Jianhua Tao, Ya Li, Jian Huang, Zheng Lian |
| 2019 | ICASSP | Self-attention Based Model for Punctuation Prediction Using Word and Speech Embeddings. | Jiangyan Yi, Jianhua Tao |
| 2019 | ICASSP | Language-invariant Bottleneck Features from Adversarial End-to-end Acoustic Models for Low Resource Speech Recognition. | Jiangyan Yi, Jianhua Tao, Ye Bai |
| 2019 | ICASSP | Drawing Order Recovery for Handwriting Chinese Characters. | Bocheng Zhao, Minghao Yang, Jianhua Tao |
| 2019 | Interspeech | Learn Spelling from Teachers: Transferring Knowledge from Language Models to Sequence-to-Sequence Speech Recognition. | Ye Bai, Jiangyan Yi, Jianhua Tao, Zhengkun Tian, Zhengqi Wen |
| 2019 | Interspeech | A Time Delay Neural Network with Shared Weight Self-Attention for Small-Footprint Keyword Spotting. | Ye Bai, Jiangyan Yi, Jianhua Tao, Zhengqi Wen, Zhengkun Tian, Chenghao Zhao, Cunhang Fan |
| 2019 | Interspeech | Discriminative Learning for Monaural Speech Separation Using Deep Embedding Features. | Cunhang Fan, Bin Liu, Jianhua Tao, Jiangyan Yi, Zhengqi Wen |
| 2019 | Interspeech | Conversational Emotion Analysis via Attention Mechanisms. | Zheng Lian, Jianhua Tao, Bin Liu, Jian Huang |
| 2019 | Interspeech | Unsupervised Representation Learning with Future Observation Prediction for Speech Emotion Recognition. | Zheng Lian, Jianhua Tao, Bin Liu, Jian Huang |
| 2019 | Interspeech | Automatic Depression Level Detection via ℓ | Mingyue Niu, Jianhua Tao, Bin Liu, Cunhang Fan |
| 2019 | Interspeech | Self-Attention Transducers for End-to-End Speech Recognition. | Zhengkun Tian, Jiangyan Yi, Jianhua Tao, Ye Bai, Zhengqi Wen |
| 2019 | Interspeech | Forward-Backward Decoding for Regularizing End-to-End TTS. | Yibin Zheng, Xi Wang, Lei He, Shifeng Pan, Frank K. Soong, Zhengqi Wen, Jianhua Tao |
| 2018 | ICASSP | End-to-End Continuous Emotion Recognition from Video Using 3D Convlstm Networks. | Jian Huang, Ya Li, Jianhua Tao, Zheng Lian, Jiangyan Yi |
| 2018 | ICASSP | Adversarial Multilingual Training for Low-Resource Speech Recognition. | Jiangyan Yi, Jianhua Tao, Zhengqi Wen, Ye Bai |
| 2018 | ICPR | Self-Talk: Responses to Users' Opinions and Challenges in Human Computer Dialog. | Minghao Yang, Na Sheng Ruo Yang, Ke Zhang, Jianhua Tao |
| 2018 | ICPR | Reducing Tongue Shape Dimensionality from Hundreds of Available Resources Using Autoencoder. | Minghao Yang, Dawei Zhang, Jianhua Tao |
| 2018 | ICPR | Pen Tip Motion Prediction for Handwriting Drawing Order Recovery using Deep Neural Network. | Bocheng Zhao, Minghao Yang, Jianhua Tao |
| 2018 | Interspeech | Transfer Learning Based Progressive Neural Networks for Acoustic Modeling in Statistical Parametric Speech Synthesis. | Ruibo Fu, Jianhua Tao, Yibin Zheng, Zhengqi Wen |
| 2018 | Interspeech | Deep Metric Learning for the Target Cost in Unit-Selection Speech Synthesizer. | Ruibo Fu, Jianhua Tao, Yibin Zheng, Zhengqi Wen |
| 2018 | Interspeech | Speech Emotion Recognition from Variable-Length Inputs with Triplet Loss Function. | Jian Huang, Ya Li, Jianhua Tao, Zhen Lian |
| 2018 | Interspeech | Deep Noise Tracking Network: A Hybrid Signal Processing/Deep Learning Approach to Speech Enhancement. | Shuai Nie, Shan Liang, Bin Liu, Yaping Zhang, Wenju Liu, Jianhua Tao |
| 2018 | Interspeech | Sparsity-Constrained Weight Mapping for Head-Related Transfer Functions Individualization from Anthropometric Features. | Xiaoke Qi, Jianhua Tao |
| 2018 | Interspeech | On the Application and Compression of Deep Time Delay Neural Network for Embedded Statistical Parametric Speech Synthesis. | Yibin Zheng, Jianhua Tao, Zhengqi Wen, Ruibo Fu |
| 2018 | Interspeech | BLSTM-CRF Based End-to-End Prosodic Boundary Prediction with Context Sensitive Embeddings in a Text-to-Speech Front-End. | Yibin Zheng, Jianhua Tao, Zhengqi Wen, Ya Li |
| 2017 | ICASSP | A novel pitch extraction based on jointly trained deep BLSTM Recurrent Neural Networks with bottleneck features. | Bin Liu, Jianhua Tao, Dawei Zhang, Yibin Zheng |
| 2017 | Interspeech | A Domain Knowledge-Assisted Nonlinear Model for Head-Related Transfer Functions Based on Bottleneck Deep Neural Network. | Xiaoke Qi, Jianhua Tao |
| 2017 | Interspeech | Distilling Knowledge from an Ensemble of Models for Punctuation Prediction. | Jiangyan Yi, Jianhua Tao, Zhengqi Wen, Ya Li |
| 2017 | Interspeech | Investigating Efficient Feature Representation Methods and Training Objective for BLSTM-Based Phone Duration Prediction. | Yibin Zheng, Jianhua Tao, Zhengqi Wen, Ya Li, Bin Liu |
| 2016 | ICASSP | Long short term memory recurrent neural network based encoding method for emotion recognition in video. | Linlin Chao, Jianhua Tao, Minghao Yang, Ya Li, Zhengqi Wen |
| 2016 | ICASSP | Extraction of tongue contour in real-time magnetic resonance imaging sequences. | Dawei Zhang, Minghao Yang, Jianhua Tao, Yang Wang, Bin Liu, Danish Bukhari |
| 2016 | Interspeech | A Novel Research to Artificial Bandwidth Extension Based on Deep BLSTM Recurrent Neural Networks and Exemplar-Based Sparse Representation. | Bin Liu, Jianhua Tao |
| 2016 | Interspeech | A Sparse Spherical Harmonic-Based Model in Subbands for Head-Related Transfer Functions. | Xiaoke Qi, Jianhua Tao |
| 2016 | Interspeech | The Parameterized Phoneme Identity Feature as a Continuous Real-Valued Vector for Neural Network Based Speech Synthesis. | Zhengqi Wen, Ya Li, Jianhua Tao |
| 2016 | Interspeech | Improving Prosodic Boundaries Prediction for Mandarin Speech Synthesis by Using Enhanced Embedding Feature and Model Fusion Approach. | Yibin Zheng, Ya Li, Zhengqi Wen, Xingguang Ding, Jianhua Tao |
| 2015 | ACII | Multi task sequence learning for depression scale prediction from video. | Linlin Chao, Jianhua Tao, Minghao Yang, Ya Li |
| 2015 | ACII | From simulated speech to natural speech, what are the robust features for emotion recognition? | Ya Li, Linlin Chao, Yazhu Liu, Wei Bao, Jianhua Tao |
| 2015 | ICASSP | Voice quality: Not only about "you" but also about "your interlocutor". | Ya Li, Nick Campbell, Jianhua Tao |
| 2015 | ICASSP | Evaluation of linear regression for speaker adaptation in HMM-based articulatory movements estimation. | Hao Li, Jianhua Tao, Yang Wang |
| 2015 | ICASSP | Estimate articulatory MRI series from acoustic signal using deep architecture. | Hao Li, Jianhua Tao, Minghao Yang, Bin Liu |
| 2015 | Interspeech | A novel method of artificial bandwidth extension using deep architecture. | Bin Liu, Jianhua Tao, Zhengqi Wen, Ya Li, Danish Bukhari |
| 2015 | Interspeech | Combining extreme learning machine and decision tree for duration prediction in HMM based speech synthesis. | Yang Wang, Minghao Yang, Zhengqi Wen, Jianhua Tao |
| 2014 | ICASSP | Tongue shape conversion with non-parallel training data. | Hao Li, Minghao Yang, Jianhua Tao |
| 2014 | ICASSP | A novel hybrid mandarin speech synthesis system using different base units for model training and concatenation. | Ran Zhang, Jianhua Tao, Ya Li, Zhengqi Wen |
| 2014 | Interspeech | Improving Mandarin prosodic boundary prediction with rich syntactic features. | Hao Che, Jianhua Tao, Ya Li |
| 2014 | Interspeech | A hierarchical viterbi algorithm for Mandarin hybrid speech synthesis system. | Ran Zhang, Zhengqi Wen, Jianhua Tao, Ya Li, Bing Liu, Xiaoyan Lou |
| 2013 | ACII | Bayesian Inference Based Temporal Modeling for Naturalistic Affective Expression Classification. | Linlin Chao, Jianhua Tao, Minghao Yang, Ya Li |
| 2013 | ICASSP | Speaker-independent lips and tongue visualization of vowels. | Hao Li, Minghao Yang, Jianhua Tao |
| 2013 | ICASSP | Extraction of tongue contour in X-ray videos. | Minghao Yang, Jianhua Tao, Dawei Zhang |
| 2012 | Interspeech | Pitch-Scaled Analysis based Residual Reconstruction for Speech Analysis and Synthesis. | Zhengqi Wen, Hideki Kawahara, Jianhua Tao |
| 2012 | Interspeech | Amplitude Spectrum based Excitation Model for HMM-based Speech Synthesis. | Zhengqi Wen, Jianhua Tao |
| 2011 | ACII | The CASIA Audio Emotion Recognition Method for Audio/Visual Emotion Challenge 2011. | Shifeng Pan, Jianhua Tao, Ya Li |
| 2011 | ICASSP | Global variance modeling on frequency domain delta LSP for HMM-based speech synthesis. | Shifeng Pan, Yoshihiko Nankaku, Keiichi Tokuda, Jianhua Tao |
| 2011 | Interspeech | Hierarchical Stress Modeling in Mandarin Text-to-Speech. | Ya Li, Jianhua Tao, Xiaoying Xu |
| 2011 | Interspeech | Inverse Filtering Based Harmonic Plus Noise Excitation Model for HMM-Based Speech Synthesis. | Zhengqi Wen, Jianhua Tao |
| 2010 | ICMI | Mood avatar: automatic text-driven head motion synthesis. | Kaihui Mu, Jianhua Tao, Jianfeng Che, Minghao Yang |
| 2010 | Interspeech | Text-based unstressed syllable prediction in Mandarin. | Ya Li, Jianhua Tao, Meng Zhang, Shifeng Pan, Xiaoying Xu |
| 2010 | Interspeech | A novel hybrid approach for Mandarin speech synthesis. | Shifeng Pan, Meng Zhang, Jianhua Tao |
| 2009 | ACII | A multiple perception model on emotional speech. | Jianhua Tao, Aijun Li, Shifeng Pan |
| 2009 | ACII | Categorizing terms' subjectivity and polarity manually for opinion mining in Chinese. | Xiaoying Xu, Aijun Li, Liping Hu, Jianhua Tao |
| 2009 | Interspeech | Dimension reducing of LSF parameters based on radial basis function neural network. | Hongjun Sun, Jianhua Tao, Huibin Jia |
| 2008 | ICASSP | Tree-guided transformation-based homograph disambiguation in Mandarin TTS system. | Fangzhou Liu, Qin Shi, Jianhua Tao |
| 2008 | ICASSP | Text-independent voice conversion based on state mapped codebook. | Meng Zhang, Jianhua Tao, Jilei Tian, Xia Wang |
| 2007 | ACII | Combining Audio and Video by Dominance in Bimodal Emotion Recognition. | Lixing Huang, Le Xin, Liyue Zhao, Jianhua Tao |
| 2007 | ACII | What Should a Generic Emotion Markup Language Be Able to Represent? | Marc Schrder, Laurence Devillers, Kostas Karpouzis, Jean-Claude Martin, Catherine Pelachaud, Christian Peter, Hannes Pirker, Bjrn W. Schuller, Jianhua Tao, Ian Wilson |
| 2007 | ACII | Expressive Face Animation Synthesis Based on Dynamic Mapping Method. | Panrong Yin, Liyue Zhao, Lixing Huang, Jianhua Tao |
| 2007 | ICASSP | A Novel HMM-Based TTS System using Both Continuous HMMS and Discrete HMMS. | Jian Yu, Meng Zhang, Jianhua Tao, Xia Wang |
| 2007 | ICCS | Speech Emotion Recognition Based on a Fusion of All-Class and Pairwise-Class Feature Selection. | Jia Liu, Chun Chen, Jiajun Bu, Mingyu You, Jianhua Tao |
| 2007 | ICIP | Dynamic Audio-Visual Mapping using Fused Hidden Markov Model Inversion Method. | Le Xin, Jianhua Tao, Tieniu Tan |
| 2007 | Interspeech | Modeling incompletion phenomenon in Mandarin dialog prosody. | Jian Yu, Lixing Huang, Jianhua Tao, Xia Wang |
| 2006 | ICASSP | Applying Pitch Target Model to Convert F0 Contour for Expressive Mandarin Speech Synthesis. | Yongguo Kang, Jianhua Tao, Bo Xu |
| 2006 | ICASSP | A New Pitch Generation Model Based on Internal Dependence of Pitch Contour for Manadrin TTS System. | Jian Yu, Wanzhi Zhang, Jianhua Tao |
| 2006 | ICPR | Emotional Speech Analysis on Nonlinear Manifold. | Mingyu You, Chun Chen, Jiajun Bu, Jia Liu, Jianhua Tao |
| 2005 | ACII | A Hybrid GMM and Codebook Mapping Method for Spectral Conversion. | Yongguo Kang, Zhiwei Shuang, Jianhua Tao, Wei Zhang, Bo Xu |
| 2005 | ACII | Personalized Facial Animation Based on 3D Model Fitting from Two Orthogonal Face Images. | Yonglin Li, Jianhua Tao |
| 2005 | ACII | Features Importance Analysis for Emotional Speech Classification. | Jianhua Tao, Yongguo Kang |
| 2005 | ACII | Affective Computing: A Review. | Jianhua Tao, Tieniu Tan |
| 2005 | ACII | Dynamic Mapping Method Based Speech Driven Face Animation System. | Panrong Yin, Jianhua Tao |
| 2005 | ICCV | Automatic 3D Face Modeling from Video. | Le Xin, Qiang Wang, Jianhua Tao, Xiaoou Tang, Tieniu Tan, Harry Shum |
| 2005 | Interspeech | Chinese prosodic phrasing with a constraint-based approach. | Honghui Dong, Jianhua Tao, Bo Xu |
| 2004 | ICMI | Emotional Chinese talking head system. | Jianhua Tao, Tieniu Tan |
| 2004 | Interspeech | Context based emotion detection from text input. | Jianhua Tao |
| 2004 | Interspeech | A new multicomponent AM-FM demodulation with predicting frequency boundaries and its application to formant estimation. | Bo Xu, Jianhua Tao, Yongguo Kang |
| 2003 | ICASSP | Auditive learning based Chinese F0 prediction. | Jianhua Tao, Xing Ni |
| 2003 | ICASSP | Chinese prosodic phrasing with extended features. | Sheng Zhao, Jianhua Tao, DanLing Jiang |
| 2003 | Interspeech | Emotion control of Chinese speech synthesis in natural environment. | Jianhua Tao |
| 2002 | Interspeech | Clustering and feature learning based F0 prediction for Chinese speech synthesis. | Jianhua Tao, Lianhong Cai |
| 2002 | Interspeech | Prosodic phrasing with inductive learning. | Sheng Zhao, Jianhua Tao, Lianhong Cai |
| 2000 | Interspeech | Data-driven importance analysis of linguistic and phonetic information. | Achim F. Mller, Jianhua Tao, Rdiger Hoffmann |
| 2000 | Interspeech | Data-driven importance analysis of linguistic and phonetic information. | Achim F. Mller, Jianhua Tao, Rdiger Hoffmann |