Skip to content

Xinfa Zhu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

16

Venues

5

Active years

2023–2026

Best venue rank

A*

Where they publish

Papers

16 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIKALL-E: Autoregressive Speech Synthesis with Next-Distribution Prediction.Kangxiang Xia, Xinfa Zhu, Jixun Yao, Wenjie Tian, Wenhao Li, Lei Xie
2025ACLLLaSE-G1: Incentivizing Generalization Capability for LLaMA-based Speech Enhancement.Boyi Kang, Xinfa Zhu, Zihan Zhang, Zhen Ye, Mingshuai Liu, Ziqian Wang, Yike Zhu, Guobin Ma, Jun Chen, Longshuai Xiao, Chao Weng, Wei Xue, Lei Xie
2025ASRULlasa+: Free Lunch for Accelerated and Streaming Llama-Based Speech Synthesis.Wenjie Tian, Xinfa Zhu, Hanke Xie, Zhen Ye, Wei Xue, Lei Xie
2025ASRUXEmoRAG: Cross-Lingual Emotion Transfer with Controllable Intensity Using Retrieval-Augmented Generation.Tianlun Zuo, Jingbin Hu, Yuke Li, Xinfa Zhu, Hai Li, Ying Yan, Junhui Liu, Danming Xie, Lei Xie
2025ICASSPZSVC: Zero-shot Style Voice Conversion with Disentangled Latent Diffusion Models and Adversarial Training.Xinfa Zhu, Lei He, Yujia Xiao, Xi Wang, Xu Tan, Sheng Zhao, Lei Xie
2025InterspeechWeakly Supervised Data Refinement and Flexible Sequence Compression for Efficient Thai LLM-based ASR.Mingchen Shao, Xinfa Zhu, Chengyou Wang, Bingshen Mu, Hai Li, Ying Yan, Junhui Liu, Danming Xie, Lei Xie
2025InterspeechFlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching.Ziqian Wang, Zikai Liu, Xinfa Zhu, Yike Zhu, Mingshuai Liu, Jun Chen, Longshuai Xiao, Chao Weng, Lei Xie
2025InterspeechU-SAM: An Audio Language Model for Unified Speech, Audio, and Music Understanding.Ziqian Wang, Xianjun Xia, Xinfa Zhu, Lei Xie
2024ICASSPSpontts: Modeling and Transferring Spontaneous Style for TTS.Hanzhao Li, Xinfa Zhu, Liumeng Xue, Yang Song, Yunlin Chen, Lei Xie
2024ICASSPSELM: Speech Enhancement using Discrete Tokens and Language Models.Ziqian Wang, Xinfa Zhu, Zihan Zhang, Yuanjun Lv, Ning Jiang, Guoqing Zhao, Lei Xie
2024InterspeechText-aware and Context-aware Expressive Audiobook Speech Synthesis.Dake Guo, Xinfa Zhu, Liumeng Xue, Yongmao Zhang, Wenjie Tian, Lei Xie
2024InterspeechSingle-Codec: Single-Codebook Speech Codec towards High-Performance Speech Generation.Hanzhao Li, Liumeng Xue, Haohan Guo, Xinfa Zhu, Yuanjun Lv, Lei Xie, Yunlin Chen, Hao Yin, Zhifei Li
2024InterspeechVec-Tok-VC+: Residual-enhanced Robust Zero-shot Voice Conversion with Progressive Constraints in a Dual-mode Training Strategy.Linhan Ma, Xinfa Zhu, Yuanjun Lv, Zhichao Wang, Ziqian Wang, Wendi He, Hongbin Zhou, Lei Xie
2023ASRUHIGNN-TTS: Hierarchical Prosody Modeling With Graph Neural Networks for Expressive Long-Form TTS.Dake Guo, Xinfa Zhu, Liumeng Xue, Tao Li, Yuanjun Lv, Yuepeng Jiang, Lei Xie
2023ASRUZero-Shot Emotion Transfer for Cross-Lingual Speech Synthesis.Yuke Li, Xinfa Zhu, Yi Lei, Hai Li, Junhui Liu, Danming Xie, Lei Xie
2023ICASSPMulti-Speaker Expressive Speech Synthesis via Multiple Factors Decoupling.Xinfa Zhu, Yi Lei, Kun Song, Yongmao Zhang, Tao Li, Lei Xie