| 2026 | ACL | From Inheritance to Saturation: Disentangling the Evolution of Visual Redundancy for Architecture-Aware MLLM Inference Acceleration. | Jiaqi Shi, Xulong Zhang, Yuechan Li, Xiaoyang Qu, Jianzong Wang |
| 2026 | ISCAS | UniMAC: Multi-Precision MAC with a Unified Computing Architecture for Efficient Large Language Model Inference. | Xiao Cong, Xingyuan Hu, Juntao Liu, Xulong Zhang, Haoran Geng, Qi Wu, Yuan Du, Li Du |
| 2025 | ICASSP | Graph Contrastive Learning with Decoupled Augmentation. | Shihao Gao, Caoshuo Li, Cunli Mao, Xulong Zhang, Xiaoyang Qu, Taisong Jin, Jianzong Wang |
| 2025 | ICASSP | Homogeneous Graph Extraction: An Approach to Learning Heterogeneous Graph Embedding. | Shihao Gao, Xiaoyan Yu, Yu Cai, Xulong Zhang, Jianzong Wang, Taisong Jin |
| 2025 | ICASSP | CycleFlow: Leveraging Cycle Consistency in Flow Matching for Speaker Style Adaptation. | Ziqi Liang, Xulong Zhang, Chang Liu, Xiaoyang Qu, Weifeng Zhao, Jianzong Wang |
| 2025 | ICONIP | Turbo-TTS: Enhancing Diffusion Model TTS with an Improved ODE Solver. | Xulong Zhang, Jiashu Wang, Xiaoyang Qu, Hui Tian, Jianzong Wang |
| 2025 | IJCNN | Rano: Restorable Speaker Anonymization via Conditional Invertible Neural Network. | Jianzong Wang, Xulong Zhang, Xiaoyang Qu |
| 2025 | IJCNN | Bridging the Modality Gap: Semantic-Calibrated Zero-shot Speech Emotion Captioning. | Jianzong Wang, Xulong Zhang, Xiaoyang Qu |
| 2025 | IJCNN | Logic Consistency Makes Large Language Models Personalized Reasoning Teachers. | Bingyuan Zhang, Xulong Zhang, Yong Zhang, Jun Yu, Jianzong Wang |
| 2024 | APWEB | RSET: Remapping-Based Sorting Method for Emotion Transfer Speech Synthesis. | Haoxiang Shi, Jianzong Wang, Xulong Zhang, Ning Cheng, Jun Yu, Jing Xiao |
| 2024 | CSCWD | Medical Speech Symptoms Classification via Disentangled Representation. | Jianzong Wang, Pengcheng Li, Xulong Zhang, Ning Cheng, Jing Xiao |
| 2024 | EMNLP | IDEAW: Robust Neural Audio Watermarking with Invertible Dual-Embedding. | Pengcheng Li, Xulong Zhang, Jing Xiao, Jianzong Wang |
| 2024 | ICASSP | Learning Disentangled Speech Representations with Contrastive Learning and Time-Invariant Retrieval. | Yimin Deng, Huaizhen Tang, Xulong Zhang, Ning Cheng, Jing Xiao, Jianzong Wang |
| 2024 | ICASSP | ED-TTS: Multi-Scale Emotion Modeling Using Cross-Domain Emotion Diarization for Emotional Speech Synthesis. | Haobin Tang, Xulong Zhang, Ning Cheng, Jing Xiao, Jianzong Wang |
| 2024 | ICASSP | EmoTalker: Emotionally Editable Talking Face Generation via Diffusion Model. | Bingyuan Zhang, Xulong Zhang, Ning Cheng, Jun Yu, Jing Xiao, Jianzong Wang |
| 2024 | IJCNN | Learning Expressive Disentangled Speech Representations with Soft Speech Units and Adversarial Style Augmentation. | Yimin Deng, Jianzong Wang, Xulong Zhang, Ning Cheng, Jing Xiao |
| 2024 | IJCNN | EAD-VC: Enhancing Speech Auto-Disentanglement for Voice Conversion with IFUB Estimator and Joint Text-Guided Consistent Learning. | Ziqi Liang, Jianzong Wang, Xulong Zhang, Yong Zhang, Ning Cheng, Jing Xiao |
| 2024 | IJCNN | MAIN-VC: Lightweight Speech Representation Disentanglement for One-shot Voice Conversion. | Pengcheng Li, Jianzong Wang, Xulong Zhang, Yong Zhang, Jing Xiao, Ning Cheng |
| 2024 | IJCNN | QLSC: A Query Latent Semantic Calibrator for Robust Extractive Question Answering. | Sheng Ouyang, Jianzong Wang, Yong Zhang, Zhitao Li, Ziqi Liang, Xulong Zhang, Ning Cheng, Jing Xiao |
| 2024 | IJCNN | ConTuner: Singing Voice Beautifying with Pitch and Expressiveness Condition. | Jianzong Wang, Pengcheng Li, Xulong Zhang, Ning Cheng, Jing Xiao |
| 2024 | IJCNN | EfficientASR: Speech Recognition Network Compression via Attention Redundancy and Chunk-Level FFN Optimization. | Jianzong Wang, Ziqi Liang, Xulong Zhang, Ning Cheng, Jing Xiao |
| 2023 | ADMA | Machine Unlearning Methodology Based on Stochastic Teacher Network. | Xulong Zhang, Jianzong Wang, Ning Cheng, Yifu Sun, Chuanyao Zhang, Jing Xiao |
| 2023 | ADMA | Voice Conversion with Denoising Diffusion Probabilistic GAN Models. | Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2023 | ADMA | Symbolic and Acoustic: Multi-domain Music Emotion Modeling for Instrumental Music. | Kexin Zhu, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2023 | APWEB | An Empirical Study of Attention Networks for Semantic Segmentation. | Hao Guo, Hongbiao Si, Guilin Jiang, Wei Zhang, Zhiyan Liu, Xuanyi Zhu, Xulong Zhang, Yang Liu |
| 2023 | APWEB | Stock Volatility Prediction Based on Transformer Model Using Mixed-Frequency Data. | Wenting Liu, Zhaozhong Gui, Guilin Jiang, Lihua Tang, Lichun Zhou, Wan Leng, Xulong Zhang, Yujiang Liu |
| 2023 | APWEB | A Hierarchy-Based Analysis Approach for Blended Learning: A Case Study with Chinese Students. | Yu Ye, Gongjin Zhang, Hongbiao Si, Liang Xu, Shenghua Hu, Yong Li, Xulong Zhang, Kaiyu Hu, Fangzhou Ye |
| 2023 | APWEB | Research on the Impact of Executive Shareholding on New Investment in Enterprises Based on Multivariable Linear Regression Model. | Shanyi Zhou, Ning Yan, Zhijun Li, Mo Geng, Xulong Zhang, Hongbiao Si, Lihua Tang, Wenyuan Sun, Longda Zhang, Yi Cao |
| 2023 | ICASSP | Improving Music Genre Classification from multi-modal Properties of Music and Genre Correlations Perspective. | Ganghui Ru, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2023 | ICASSP | Learning Speech Representations with Flexible Hidden Feature Dimensions. | Huaizhen Tang, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2023 | ICASSP | VQ-CL: Learning Disentangled Speech Representations with Contrastive Learning and Vector Quantization. | Huaizhen Tang, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2023 | ICASSP | QI-TTS: Questioning Intonation Control for Emotional Speech Synthesis. | Haobin Tang, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2023 | ICASSP | Dynamic Alignment Mask CTC: Improved Mask CTC With Aligned Cross Entropy. | Xulong Zhang, Haobin Tang, Jianzong Wang, Ning Cheng, Jian Luo, Jing Xiao |
| 2023 | ICASSP | Improving EEG-based Emotion Recognition by Fusing Time-Frequency and Spatial Representations. | Kexin Zhu, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2023 | IJCNN | SAR: Self-Supervised Anti-Distortion Representation for End-To-End Speech Model. | Jianzong Wang, Xulong Zhang, Haobin Tang, Aolan Sun, Ning Cheng, Jing Xiao |
| 2023 | Interspeech | Investigation of Music Emotion Recognition Based on Segmented Semi-Supervised Learning. | Yifu Sun, Xulong Zhang, Jianzong Wang, Ning Cheng, Kaiyu Hu, Jing Xiao |
| 2023 | Interspeech | EmoMix: Emotion Mixing via Diffusion Models for Emotional Speech Synthesis. | Haobin Tang, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2023 | ICTAI | Contrastive Latent Space Reconstruction Learning for Audio-Text Retrieval. | Kaiyi Luo, Xulong Zhang, Jianzong Wang, Huaxiong Li, Ning Cheng, Jing Xiao |
| 2023 | ICTAI | AOSR-Net: All-in-One Sandstorm Removal Network. | Yazhong Si, Xulong Zhang, Fan Yang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2023 | ICTAI | FastGraphTTS: An Ultrafast Syntax-Aware Speech Synthesis Framework. | Jianzong Wang, Xulong Zhang, Aolan Sun, Ning Cheng, Jing Xiao |
| 2022 | APWEB | Shallow Diffusion Motion Model for Talking Face Generation from Speech. | Xulong Zhang, Jianzong Wang, Ning Cheng, Edward Xiao, Jing Xiao |
| 2022 | ICASSP | Avqvc: One-Shot Voice Conversion By Vector Quantization With Applying Contrastive Learning. | Huaizhen Tang, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2022 | ICASSP | DRVC: A Framework of Any-to-Any Voice Conversion with Self-Supervised Learning. | Qiqi Wang, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2022 | ICASSP | nnSpeech: Speaker-Guided Conditional Variational Autoencoder for Zero-Shot Multi-speaker text-to-speech. | Botao Zhao, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2022 | ICONIP | Boosting StarGANs for Voice Conversion with Contrastive Discriminator. | Shijing Si, Jianzong Wang, Xulong Zhang, Xiaoyang Qu, Ning Cheng, Jing Xiao |
| 2022 | IJCNN | SUSing: SU-net for Singing Voice Synthesis. | Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2022 | IJCNN | MDCNN-SID: Multi-scale Dilated Convolution Network for Singer Identification. | Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2022 | IJCNN | TDASS: Target Domain Adaptation Speech Synthesis Framework for Multi-speaker Low-Resource TTS. | Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2022 | IJCNN | Singer Identification for Metaverse with Timbral and Middle-Level Perceptual Features. | Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2022 | IJCNN | MetaSID: Singer Identification with Domain Adaptation for Metaverse. | Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2022 | Interspeech | Tiny-Sepformer: A Tiny Time-Domain Transformer Network For Speech Separation. | Jian Luo, Jianzong Wang, Ning Cheng, Edward Xiao, Xulong Zhang, Jing Xiao |
| 2022 | ICTAI | Pre-Avatar: An Automatic Presentation Generation Framework Leveraging Talking Avatar. | Aolan Sun, Xulong Zhang, Tiandong Ling, Jianzong Wang, Ning Cheng, Jing Xiao |
| 2021 | ASRU | TGAVC: Improving Autoencoder Voice Conversion with Text-Guided and Adversarial Training. | Huaizhen Tang, Xulong Zhang, Jianzong Wang, Ning Cheng, Zhen Zeng, Edward Xiao, Jing Xiao |
| 2021 | ASRU | Cyclegean: Cycle Generative Enhanced Adversarial Network for Voice Conversion. | Xulong Zhang, Jianzong Wang, Ning Cheng, Edward Xiao, Jing Xiao |
| 2021 | ICASSP | Singer Identification Using Deep Timbre Feature Learning with KNN-NET. | Xulong Zhang, Jiale Qian, Yi Yu, Yifu Sun, Wei Li |
| 2021 | TrustCom | Social Spammer Detection Based on Semi-Supervised Learning. | Xulong Zhang, Frank Jiang, Ran Zhang, Shupeng Li, Yang Zhou |