| 2026 | AAAI | STOLA: Self-Adaptive Touch-Language Framework for Tactile Commonsense Reasoning in Open-Ended Scenarios. | Ning Cheng, Jinan Xu, Jialing Chen, Bin Fang, Wenjuan Han |
| 2026 | ACL | Astra: Activation-Space Tail-Eigenvector Low-Rank Adaptation of Large Language Models. | Kainan Liu, Yong Zhang, Ning Cheng, Yun Zhu, Yanmeng Wang, Shaojun Wang, Jing Xiao |
| 2025 | ACL | Dynamic Attention-Guided Context Decoding for Mitigating Context Faithfulness Hallucinations in Large Language Models. | Huangyw Huangyw, Yong Zhang, Ning Cheng, Zhitao Li, Shaojun Wang, Jing Xiao |
| 2025 | EMNLP | GRASP: Replace Redundant Layers with Adaptive Singular Parameters for Efficient Model Compression. | Kainan Liu, Yong Zhang, Ning Cheng, Zhitao Li, Shaojun Wang, Jing Xiao |
| 2025 | ICASSP | Improving Contextual ASR with Enhanced Phrase-Level Representation Based on MCTC Loss. | Ming Fang, Tao Wei, Kai Guo, Ziyang Zhuang, Yan Shi, Ning Cheng, Shaojun Wang, Jing Xiao |
| 2025 | ICASSP | Token-Level Contextual Network with Ladder-Shaped Attention for End-to-End ASR. | Ming Fang, Kai Guo, Tao Wei, Ziyang Zhuang, Yan Shi, Ning Cheng, Shaojun Wang, Jing Xiao |
| 2025 | ICASSP | LEF-TTS: Lightweight and Efficient End-to-End Text-to-Speech Synthesis With Multi-Stream Generator. | Yan Shi, Jin Shi, Minchuan Chen, Chenfeng Miao, Ming Fang, Ning Cheng, Shaojun Wang, Jing Xiao |
| 2025 | ICASSP | Self-Enhanced Reasoning Training: Activating Latent Reasoning in Small Models for Enhanced Reasoning Distillation. | Yong Zhang, Bingyuan Zhang, Zhitao Li, Ming Li, Ning Cheng, Minchuan Chen, Tao Wei, Jun Ma, Shaojun Wang, Jing Xiao |
| 2025 | ICASSP | EffectiveASR: A Single-Step Non-Autoregressive Mandarin Speech Recognition Architecture with High Accuracy and Inference Speed. | Ziyang Zhuang, Chenfeng Miao, Kun Zou, Ming Fang, Tao Wei, Zijian Li, Ning Cheng, Wei Hu, Shaojun Wang, Jing Xiao |
| 2025 | Interspeech | Enhancing Serialized Output Training for Multi-Talker ASR with Soft Monotonic Alignment and Utterance-level Timestamp. | Fengyun Tan, Tao Wei, Kun Zou, Ning Cheng, Shaojun Wang, Jing Xiao |
| 2025 | Interspeech | Towards Efficiently Whisper Fine-tuning with Monotonic Alignments. | Ziyang Zhuang, Tao Wei, Ming Fang, Ning Cheng, Shaojun Wang, Jing Xiao |
| 2025 | NAACL | Multi-Stage LLM Fine-Tuning with a Continual Learning Setting. | Changhao Guan, Chao Huang, Hongliang Li, You Li, Ning Cheng, Zihe Liu, Yufeng Chen, Jinan Xu, Jian Liu |
| 2024 | ACL | Superfiltering: Weak-to-Strong Data Filtering for Fast Instruction-Tuning. | Ming Li, Yong Zhang, Shwai He, Zhitao Li, Hongyu Zhao, Jianzong Wang, Ning Cheng, Tianyi Zhou |
| 2024 | APWEB | RSET: Remapping-Based Sorting Method for Emotion Transfer Speech Synthesis. | Haoxiang Shi, Jianzong Wang, Xulong Zhang, Ning Cheng, Jun Yu, Jing Xiao |
| 2024 | COLING | CollabKG: A Learnable Human-Machine-Cooperative Information Extraction Toolkit for (Event) Knowledge Graph Construction. | Xiang Wei, Yufeng Chen, Ning Cheng, Xingyu Cui, Jinan Xu, Wenjuan Han |
| 2024 | CSCWD | Medical Speech Symptoms Classification via Disentangled Representation. | Jianzong Wang, Pengcheng Li, Xulong Zhang, Ning Cheng, Jing Xiao |
| 2024 | ICASSP | Learning Disentangled Speech Representations with Contrastive Learning and Time-Invariant Retrieval. | Yimin Deng, Huaizhen Tang, Xulong Zhang, Ning Cheng, Jing Xiao, Jianzong Wang |
| 2024 | ICASSP | ED-TTS: Multi-Scale Emotion Modeling Using Cross-Domain Emotion Diarization for Emotional Speech Synthesis. | Haobin Tang, Xulong Zhang, Ning Cheng, Jing Xiao, Jianzong Wang |
| 2024 | ICASSP | EmoTalker: Emotionally Editable Talking Face Generation via Diffusion Model. | Bingyuan Zhang, Xulong Zhang, Ning Cheng, Jun Yu, Jing Xiao, Jianzong Wang |
| 2024 | ICASSP | Leveraging Biases in Large Language Models: "bias-kNN" for Effective Few-Shot Learning. | Yong Zhang, Hanzhang Li, Zhitao Li, Ning Cheng, Ming Li, Jing Xiao, Jianzong Wang |
| 2024 | IJCNN | Learning Expressive Disentangled Speech Representations with Soft Speech Units and Adversarial Style Augmentation. | Yimin Deng, Jianzong Wang, Xulong Zhang, Ning Cheng, Jing Xiao |
| 2024 | IJCNN | EAD-VC: Enhancing Speech Auto-Disentanglement for Voice Conversion with IFUB Estimator and Joint Text-Guided Consistent Learning. | Ziqi Liang, Jianzong Wang, Xulong Zhang, Yong Zhang, Ning Cheng, Jing Xiao |
| 2024 | IJCNN | MAIN-VC: Lightweight Speech Representation Disentanglement for One-shot Voice Conversion. | Pengcheng Li, Jianzong Wang, Xulong Zhang, Yong Zhang, Jing Xiao, Ning Cheng |
| 2024 | IJCNN | QLSC: A Query Latent Semantic Calibrator for Robust Extractive Question Answering. | Sheng Ouyang, Jianzong Wang, Yong Zhang, Zhitao Li, Ziqi Liang, Xulong Zhang, Ning Cheng, Jing Xiao |
| 2024 | IJCNN | ConTuner: Singing Voice Beautifying with Pitch and Expressiveness Condition. | Jianzong Wang, Pengcheng Li, Xulong Zhang, Ning Cheng, Jing Xiao |
| 2024 | IJCNN | EfficientASR: Speech Recognition Network Compression via Attention Redundancy and Chunk-Level FFN Optimization. | Jianzong Wang, Ziqi Liang, Xulong Zhang, Ning Cheng, Jing Xiao |
| 2024 | NAACL | From Quantity to Quality: Boosting LLM Performance with Self-Guided Data Selection for Instruction Tuning. | Ming Li, Yong Zhang, Zhitao Li, Jiuhai Chen, Lichang Chen, Ning Cheng, Jianzong Wang, Tianyi Zhou, Jing Xiao |
| 2023 | AAAI | On the Calibration and Uncertainty with Plya-Gamma Augmentation for Dialog Retrieval Models. | Tong Ye, Shijing Si, Jianzong Wang, Ning Cheng, Zhitao Li, Jing Xiao |
| 2023 | ADMA | Machine Unlearning Methodology Based on Stochastic Teacher Network. | Xulong Zhang, Jianzong Wang, Ning Cheng, Yifu Sun, Chuanyao Zhang, Jing Xiao |
| 2023 | ADMA | Voice Conversion with Denoising Diffusion Probabilistic GAN Models. | Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2023 | ADMA | Symbolic and Acoustic: Multi-domain Music Emotion Modeling for Instrumental Music. | Kexin Zhu, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2023 | EMNLP | PRCA: Fitting Black-Box Large Language Models for Retrieval Question Answering via Pluggable Reward-Driven Contextual Adapter. | Haoyan Yang, Zhitao Li, Yong Zhang, Jianzong Wang, Ning Cheng, Ming Li, Jing Xiao |
| 2023 | ICASSP | Improving Music Genre Classification from multi-modal Properties of Music and Genre Correlations Perspective. | Ganghui Ru, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2023 | ICASSP | Learning Speech Representations with Flexible Hidden Feature Dimensions. | Huaizhen Tang, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2023 | ICASSP | VQ-CL: Learning Disentangled Speech Representations with Contrastive Learning and Vector Quantization. | Huaizhen Tang, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2023 | ICASSP | QI-TTS: Questioning Intonation Control for Emotional Speech Synthesis. | Haobin Tang, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2023 | ICASSP | Efficient Uncertainty Estimation with Gaussian Process for Reliable Dialog Response Retrieval. | Tong Ye, Zhitao Li, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2023 | ICASSP | Dynamic Alignment Mask CTC: Improved Mask CTC With Aligned Cross Entropy. | Xulong Zhang, Haobin Tang, Jianzong Wang, Ning Cheng, Jian Luo, Jing Xiao |
| 2023 | ICASSP | Improving EEG-based Emotion Recognition by Fusing Time-Frequency and Spatial Representations. | Kexin Zhu, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2023 | IJCNN | SAR: Self-Supervised Anti-Distortion Representation for End-To-End Speech Model. | Jianzong Wang, Xulong Zhang, Haobin Tang, Aolan Sun, Ning Cheng, Jing Xiao |
| 2023 | Interspeech | Boosting Chinese ASR Error Correction with Dynamic Error Scaling Mechanism. | Jiaxin Fan, Yong Zhang, Hanzhang Li, Jianzong Wang, Zhitao Li, Sheng Ouyang, Ning Cheng, Jing Xiao |
| 2023 | Interspeech | Investigation of Music Emotion Recognition Based on Segmented Semi-Supervised Learning. | Yifu Sun, Xulong Zhang, Jianzong Wang, Ning Cheng, Kaiyu Hu, Jing Xiao |
| 2023 | Interspeech | EmoMix: Emotion Mixing via Diffusion Models for Emotional Speech Synthesis. | Haobin Tang, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2023 | Interspeech | Prompt Guided Copy Mechanism for Conversational Question Answering. | Yong Zhang, Zhitao Li, Jianzong Wang, Yiming Gao, Ning Cheng, Fengying Yu, Jing Xiao |
| 2023 | ICTAI | Contrastive Latent Space Reconstruction Learning for Audio-Text Retrieval. | Kaiyi Luo, Xulong Zhang, Jianzong Wang, Huaxiong Li, Ning Cheng, Jing Xiao |
| 2023 | ICTAI | AOSR-Net: All-in-One Sandstorm Removal Network. | Yazhong Si, Xulong Zhang, Fan Yang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2023 | ICTAI | FastGraphTTS: An Ultrafast Syntax-Aware Speech Synthesis Framework. | Jianzong Wang, Xulong Zhang, Aolan Sun, Ning Cheng, Jing Xiao |
| 2022 | APWEB | Shallow Diffusion Motion Model for Talking Face Generation from Speech. | Xulong Zhang, Jianzong Wang, Ning Cheng, Edward Xiao, Jing Xiao |
| 2022 | HPCC | Supervised Contrastive Meta-learning for Few-Shot Classification. | Chuanyao Zhang, Jianzong Wang, Zhangcheng Huang, Lingwei Kong, Xiaoyang Qu, Ning Cheng, Jing Xiao |
| 2022 | ICASSP | Avqvc: One-Shot Voice Conversion By Vector Quantization With Applying Contrastive Learning. | Huaizhen Tang, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2022 | ICASSP | DRVC: A Framework of Any-to-Any Voice Conversion with Self-Supervised Learning. | Qiqi Wang, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2022 | ICASSP | VU-BERT: A Unified Framework for Visual Dialog. | Tong Ye, Shijing Si, Jianzong Wang, Rui Wang, Ning Cheng, Jing Xiao |
| 2022 | ICASSP | Self-Attention for Incomplete Utterance Rewriting. | Yong Zhang, Zhitao Li, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2022 | ICASSP | nnSpeech: Speaker-Guided Conditional Variational Autoencoder for Zero-Shot Multi-speaker text-to-speech. | Botao Zhao, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2022 | ICONIP | Boosting StarGANs for Voice Conversion with Contrastive Discriminator. | Shijing Si, Jianzong Wang, Xulong Zhang, Xiaoyang Qu, Ning Cheng, Jing Xiao |
| 2022 | IJCNN | Speech Augmentation Based Unsupervised Learning for Keyword Spotting. | Jian Luo, Jianzong Wang, Ning Cheng, Haobin Tang, Jing Xiao |
| 2022 | IJCNN | Adaptive Activation Network for Low Resource Multilingual Speech Recognition. | Jian Luo, Jianzong Wang, Ning Cheng, Zhenpeng Zheng, Jing Xiao |
| 2022 | IJCNN | SUSing: SU-net for Singing Voice Synthesis. | Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2022 | IJCNN | MDCNN-SID: Multi-scale Dilated Convolution Network for Singer Identification. | Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2022 | IJCNN | TDASS: Target Domain Adaptation Speech Synthesis Framework for Multi-speaker Low-Resource TTS. | Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2022 | IJCNN | Singer Identification for Metaverse with Timbral and Middle-Level Perceptual Features. | Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2022 | IJCNN | MetaSID: Singer Identification with Domain Adaptation for Metaverse. | Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2022 | Interspeech | Tiny-Sepformer: A Tiny Time-Domain Transformer Network For Speech Separation. | Jian Luo, Jianzong Wang, Ning Cheng, Edward Xiao, Xulong Zhang, Jing Xiao |
| 2022 | Interspeech | Speech Representation Disentanglement with Adversarial Mutual Information Learning for One-shot Voice Conversion. | Sicheng Yang, Methawee Tantrawenith, Haolin Zhuang, Zhiyong Wu, Aolan Sun, Jianzong Wang, Ning Cheng, Huaizhen Tang, Xintao Zhao, Jie Wang, Helen Meng |
| 2022 | Interspeech | Uncertainty Calibration for Deep Audio Classifiers. | Tong Ye, Shijing Si, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2022 | ICTAI | Blur the Linguistic Boundary: Interpreting Chinese Buddhist Sutra in English via Neural Machine Translation. | Denghao Li, Yuqiao Zeng, Jianzong Wang, Lingwei Kong, Zhangcheng Huang, Ning Cheng, Xiaoyang Qu, Jing Xiao |
| 2022 | ICTAI | Pre-Avatar: An Automatic Presentation Generation Framework Leveraging Talking Avatar. | Aolan Sun, Xulong Zhang, Tiandong Ling, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2021 | APWEB | A Novel Capsule Aggregation Framework for Natural Language Inference. | Chao Sun, Jianzong Wang, Fengying Yu, Ning Cheng, Jing Xiao |
| 2021 | APWEB | Self-supervised Learning for Semantic Sentence Matching with Dense Transformer Inference Network. | Fengying Yu, Jianzong Wang, Dewei Tao, Ning Cheng, Jing Xiao |
| 2021 | ASRU | Reconstructing Dual Learning for Neural Voice Conversion Using Relatively Few Samples. | Aolan Sun, Jianzong Wang, Ning Cheng, Methawee Tantrawenith, Zhiyong Wu, Helen Meng, Edward Xiao, Jing Xiao |
| 2021 | ASRU | TGAVC: Improving Autoencoder Voice Conversion with Text-Guided and Adversarial Training. | Huaizhen Tang, Xulong Zhang, Jianzong Wang, Ning Cheng, Zhen Zeng, Edward Xiao, Jing Xiao |
| 2021 | ASRU | Cyclegean: Cycle Generative Enhanced Adversarial Network for Voice Conversion. | Xulong Zhang, Jianzong Wang, Ning Cheng, Edward Xiao, Jing Xiao |
| 2021 | ICASSP | Joint Intent Detection and Slot Filling Based on Continual Learning Model. | Yanfei Hui, Jianzong Wang, Ning Cheng, Fengying Yu, Tianbo Wu, Jing Xiao |
| 2021 | ICASSP | Unidirectional Memory-Self-Attention Transducer for Online Speech Recognition. | Jian Luo, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2021 | ICASSP | LVCNet: Efficient Condition-Dependent Modeling Network for Waveform Generation. | Zhen Zeng, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2021 | IJCNN | Loss Prediction: End-to-End Active Learning Approach For Speech Recognition. | Jian Luo, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2021 | IJCNN | Transfer Ability of Monolingual Wav2vec2.0 for Low-resource Speech Recognition. | Cheng Yi, Jianzong Wang, Ning Cheng, Shiyu Zhou, Bo Xu |
| 2021 | IJCNN | A Language Model Based Pseudo-Sample Deliberation for Semi-supervised Speech Recognition. | Cheng Yi, Jianzong Wang, Ning Cheng, Shiyu Zhou, Bo Xu |
| 2021 | IJCNN | Semantic Extraction for Sentence Representation via Reinforcement Learning. | Fengying Yu, Dewei Tao, Jianzong Wang, Yanfei Hui, Ning Cheng, Jing Xiao |
| 2021 | IJCNN | CACnet: Cube Attentional CNN for Automatic Speech Recognition. | Nan Zhang, Jianzong Wang, Wenqi Wei, Xiaoyang Qu, Ning Cheng, Jing Xiao |
| 2021 | Interspeech | Dropout Regularization for Self-Supervised Learning of Transformer Encoder Speech Representation. | Jian Luo, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2021 | Interspeech | Speech2Video: Cross-Modal Distillation for Speech to Video Generation. | Shijing Si, Jianzong Wang, Xiaoyang Qu, Ning Cheng, Wenqi Wei, Xinghua Zhu, Jing Xiao |
| 2021 | Interspeech | Variational Information Bottleneck for Effective Low-Resource Audio Classification. | Shijing Si, Jianzong Wang, Huiming Sun, Jianhan Wu, Chuanyao Zhang, Xiaoyang Qu, Ning Cheng, Lei Chen, Jing Xiao |
| 2020 | APWEB | Epidemic Guard: A COVID-19 Detection System for Elderly People. | Wenqi Wei, Jianzong Wang, Ning Cheng, Yuanxu Chen, Bao Zhou, Jing Xiao |
| 2020 | ICASSP | GraphTTS: Graph-to-Sequence Modelling in Neural Text-to-Speech. | Aolan Sun, Jianzong Wang, Ning Cheng, Huayi Peng, Zhen Zeng, Jing Xiao |
| 2020 | ICASSP | Aligntts: Efficient Feed-Forward Text-to-Speech System Without Explicit Alignment. | Zhen Zeng, Jianzong Wang, Ning Cheng, Tian Xia, Jing Xiao |
| 2020 | Interspeech | Large-Scale Transfer Learning for Low-Resource Spoken Language Understanding. | Xueli Jia, Jianzong Wang, Zhiyong Zhang, Ning Cheng, Jing Xiao |
| 2020 | Interspeech | A Real-Time Robot-Based Auxiliary System for Risk Evaluation of COVID-19 Infection. | Wenqi Wei, Jianzong Wang, Jiteng Ma, Ning Cheng, Jing Xiao |
| 2020 | Interspeech | Prosody Learning Mechanism for Speech Synthesis System Without Text Length Limit. | Zhen Zeng, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2020 | Interspeech | MLNET: An Adaptive Multiple Receptive-Field Attention Neural Network for Voice Activity Detection. | Zhenpeng Zheng, Jianzong Wang, Ning Cheng, Jian Luo, Jing Xiao |
| 2019 | ICASSP | Rodent Sleep Assessment with a Trainable Video-based Approach. | Van Anh Le, Mitchell Kesler, Jong M. Rho, Ning Cheng, Kartikeya Murari |
| 2011 | Interspeech | Generalized Variable Parameter HMMs for Noise Robust Speech Recognition. | Ning Cheng, Xunying Liu, Lan Wang |
| 2010 | Interspeech | Masking property based microphone array post-filter design. | Ning Cheng, Wenju Liu, Lan Wang |
| 2009 | GLOBECOM | Grid Reconfigurable Optical-Wireless Architecture for Large Scale Municipal Mesh Access Network. | Shing-Wa Wong, Divanilson R. Campelo, Ning Cheng, S.-H. Yen, Leonid G. Kazovsky, Hyunok Lee, Donald C. Cox |
| 2008 | Interspeech | An effective microphone array post-filter in arbitrary environments. | Ning Cheng, Wenju Liu, Peng Li, Bo Xu |
| 2007 | GLOBECOM | MARIN: Demonstration of a Flexible and Dynamic Metro-Access Integrated Architecture. | Shing-Wa Wong, Wei-tao Shaw, Koussalya Balasubramanian, Ning Cheng, Leonid Kazovsky |
| 2006 | Broadnets | Burst Switching Metro-Access Ring Integrated Network. | Wei-tao Shaw, Shing-Wa Wong, Yu-Li Hsueh, Ning Cheng, Leonid G. Kazovsky |
| 2006 | GLOBECOM | MARIN: Metro-Access Ring Integrated Network. | Wei-tao Shaw, G. Kalogerakis, Shing-Wa Wong, Yu-Li Hsueh, Ning Cheng, Shing-Hwa Yen, Michel E. Marhic, Leonid G. Kazovsky |
| 2005 | ACII | Real-Time Facial Expression Recognition System Based on HMM and Feature Point Localization. | Yumei Fan, Ning Cheng, Zhiliang Wang, Jiwei Liu, Changsheng Zhu |
| 2005 | ACII | Construction of Virtual Assistant Based on Basic Emotions Theory. | Zhiliang Wang, Ning Cheng, Yumei Fan, Jiwei Liu, Changsheng Zhu |