Skip to content

Zhenhui Ye

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

15

Venues

5

Active years

2022–2025

Best venue rank

A*

Where they publish

Papers

15 indexed papers, newest first.

YearVenueTitleAuthors
2025ACLT2A-Feedback: Improving Basic Capabilities of Text-to-Audio Generation via Fine-grained AI Feedback.Zehan Wang, Ke Lei, Chen Zhu, Jiawei Huang, Sashuai Zhou, Luping Liu, Xize Cheng, Shengpeng Ji, Zhenhui Ye, Tao Jin, Zhou Zhao
2024AAAIAudioGPT: Understanding and Generating Speech, Music, Sound, and Talking Head.Rongjie Huang, Mingze Li, Dongchao Yang, Jiatong Shi, Xuankai Chang, Zhenhui Ye, Yuning Wu, Zhiqing Hong, Jiawei Huang, Jinglin Liu, Yi Ren, Yuexian Zou, Zhou Zhao, Shinji Watanabe
2024ACLMake-A-Voice: Revisiting Voice Large Language Models as Scalable Multilingual and Multitask Learners.Rongjie Huang, Chunlei Zhang, Yongqi Wang, Dongchao Yang, Jinchuan Tian, Zhenhui Ye, Luping Liu, Zehan Wang, Ziyue Jiang, Xuankai Chang, Jiatong Shi, Chao Weng, Zhou Zhao, Dong Yu
2024ICLRMega-TTS 2: Boosting Prompting Mechanisms for Zero-Shot Speech Synthesis.Ziyue Jiang, Jinglin Liu, Yi Ren, Jinzheng He, Zhenhui Ye, Shengpeng Ji, Qian Yang, Chen Zhang, Pengfei Wei, Chunfeng Wang, Xiang Yin, Zejun Ma, Zhou Zhao
2024ICLRReal3D-Portrait: One-shot Realistic 3D Talking Portrait Synthesis.Zhenhui Ye, Tianyun Zhong, Yi Ren, Jiaqi Yang, Weichuang Li, Jiawei Huang, Ziyue Jiang, Jinzheng He, Rongjie Huang, Jinglin Liu, Chen Zhang, Xiang Yin, Zejun Ma, Zhou Zhao
2024ICMLFreeBind: Free Lunch in Unified Multimodal Space via Knowledge Fusion.Zehan Wang, Ziang Zhang, Xize Cheng, Rongjie Huang, Luping Liu, Zhenhui Ye, Haifeng Huang, Yang Zhao, Tao Jin, Peng Gao, Zhou Zhao
2024ICMLInstructSpeech: Following Speech Editing Instructions via Large Language Models.Rongjie Huang, Ruofan Hu, Yongqi Wang, Zehan Wang, Xize Cheng, Ziyue Jiang, Zhenhui Ye, Dongchao Yang, Luping Liu, Peng Gao, Zhou Zhao
2023ACLRMSSinger: Realistic-Music-Score based Singing Voice Synthesis.Jinzheng He, Jinglin Liu, Zhenhui Ye, Rongjie Huang, Chenye Cui, Huadai Liu, Zhou Zhao
2023ACLAV-TranSpeech: Audio-Visual Robust Speech-to-Speech Translation.Rongjie Huang, Huadai Liu, Xize Cheng, Yi Ren, Linjun Li, Zhenhui Ye, Jinzheng He, Lichao Zhang, Jinglin Liu, Xiang Yin, Zhou Zhao
2023ACLFluentSpeech: Stutter-Oriented Automatic Speech Editing with Context-Aware Diffusion Models.Ziyue Jiang, Qian Yang, Jialong Zuo, Zhenhui Ye, Rongjie Huang, Yi Ren, Zhou Zhao
2023ACLDopplerBAS: Binaural Audio Synthesis Addressing Doppler Effect.Jinglin Liu, Zhenhui Ye, Qian Chen, Siqi Zheng, Wen Wang, Qinglin Zhang, Zhou Zhao
2023ACLCLAPSpeech: Learning Prosody from Text Context with Contrastive Language-Audio Pre-Training.Zhenhui Ye, Rongjie Huang, Yi Ren, Ziyue Jiang, Jinglin Liu, Jinzheng He, Xiang Yin, Zhou Zhao
2023ICLRGeneFace: Generalized and High-Fidelity Audio-Driven 3D Talking Face Synthesis.Zhenhui Ye, Ziyue Jiang, Yi Ren, Jinglin Liu, Jinzheng He, Zhou Zhao
2023ICMLMake-An-Audio: Text-To-Audio Generation with Prompt-Enhanced Diffusion Models.Rongjie Huang, Jiawei Huang, Dongchao Yang, Yi Ren, Luping Liu, Mingze Li, Zhenhui Ye, Jinglin Liu, Xiang Yin, Zhou Zhao
2022IJCAISyntaSpeech: Syntax-Aware Generative Adversarial Text-to-Speech.Zhenhui Ye, Zhou Zhao, Yi Ren, Fei Wu