Skip to content

Zhisheng Zheng

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

17

Venues

8

Active years

2023–2026

Best venue rank

A*

Where they publish

Papers

17 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLVoiceStar: Robust Zero-Shot Autoregressive TTS with Duration Control and Extrapolation.Puyuan Peng, Zhisheng Zheng, Shang-Wen Li, Abdelrahman Mohamed, David Harwath
2025EMNLPScaling Rich Style-Prompted Text-to-Speech Datasets.Anuj Diwan, Zhisheng Zheng, David Harwath, Eunsol Choi
2025EMNLPVoiceCraft-X: Unifying Multilingual, Voice-Cloning Speech Synthesis and Speech Editing.Zhisheng Zheng, Puyuan Peng, Anuj Diwan, Cong Phuoc Huynh, Xiaohang Sun, Zhu Liu, Vimal Bhat, David Harwath
2025ICASSPSLAM-AAC: Enhancing Audio Captioning with Paraphrasing Augmentation and CLAP-Refine through LLMs.Wenxi Chen, Ziyang Ma, Xiquan Li, Xuenan Xu, Yuzhe Liang, Zhisheng Zheng, Kai Yu, Xie Chen
2025ICASSPDRCap: Decoding CLAP Latents with Retrieval-Augmented Generation for Zero-shot Audio Captioning.Xiquan Li, Wenxi Chen, Ziyang Ma, Xuenan Xu, Yuzhe Liang, Zhisheng Zheng, Qiuqiang Kong, Xie Chen
2025ICTAICompositional Neural Distance Field with Latent Code Embedding for Dynamic Objects.Xiang Gao, Zhisheng Zheng, Alois Knoll
2024ACLemotion2vec: Self-Supervised Pre-Training for Speech Emotion Representation.Ziyang Ma, Zhisheng Zheng, Jiaxin Ye, Jinchao Li, Zhifu Gao, Shiliang Zhang, Xie Chen
2024ICASSPLeveraging Speech PTM, Text LLM, And Emotional TTS For Speech Emotion Recognition.Ziyang Ma, Wen Wu, Zhisheng Zheng, Yiwei Guo, Qian Chen, Shiliang Zhang, Xie Chen
2024ICMLBAT: Learning to Reason about Spatial Sounds with Large Language Models.Zhisheng Zheng, Puyuan Peng, Ziyang Ma, Xie Chen, Eunsol Choi, David Harwath
2024IJCAIEAT: Self-Supervised Pre-Training with Efficient Audio Transformer.Wenxi Chen, Yuzhe Liang, Ziyang Ma, Zhisheng Zheng, Xie Chen
2024InterspeechEmoBox: Multilingual Multi-corpus Speech Emotion Recognition Toolkit and Benchmark.Ziyang Ma, Mingjie Chen, Hezhao Zhang, Zhisheng Zheng, Wenxi Chen, Xiquan Li, Jiaxin Ye, Xie Chen, Thomas Hain
2023ASRUExploring Effective Distillation of Self-Supervised Speech Models for Automatic Speech Recognition.Yujin Wang, Changli Tang, Ziyang Ma, Zhisheng Zheng, Xie Chen, Wei-Qiang Zhang
2023ASRUFast-Hubert: an Efficient Training Framework for Self-Supervised Speech Representation Learning.Guanrou Yang, Ziyang Ma, Zhisheng Zheng, Yakun Song, Zhikang Niu, Xie Chen
2023ICASSPFront-End Adapter: Adapting Front-End Input of Speech Based Self-Supervised Learning for Speech Recognition.Xie Chen, Ziyang Ma, Changli Tang, Yujin Wang, Zhisheng Zheng
2023InterspeechMT4SSL: Boosting Self-Supervised Speech Representation Learning by Integrating Multiple Targets.Ziyang Ma, Zhisheng Zheng, Changli Tang, Yujin Wang, Xie Chen
2023InterspeechPushing the Limits of Unsupervised Unit Discovery for SSL Speech Representation.Ziyang Ma, Zhisheng Zheng, Guanrou Yang, Yu Wang, Chao Zhang, Xie Chen
2023InterspeechUnsupervised Active Learning: Optimizing Labeling Cost-Effectiveness for Automatic Speech Recognition.Zhisheng Zheng, Ziyang Ma, Yu Wang, Xie Chen