Skip to content

Kaizhi Qian

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

21

Venues

7

Active years

2017–2025

Best venue rank

A*

Where they publish

Papers

21 indexed papers, newest first.

YearVenueTitleAuthors
2025AAAIUniMuMo: Unified Text, Music, and Motion Generation.Han Yang, Kun Su, Yutong Zhang, Jiaben Chen, Kaizhi Qian, Gaowen Liu, Chuang Gan
2025ACLPLAY2PROMPT: Zero-shot Tool Instruction Optimization for LLM Agents via Tool Play.Wei Fang, Yang Zhang, Kaizhi Qian, James R. Glass, Yada Zhu
2025ICCVRapVerse: Coherent Vocals and Whole-Body Motion Generation from Text.Jiaben Chen, Xin Yan, Yihang Chen, Siyuan Cen, Zixin Wang, Qinwei Ma, Haoyu Zhen, Kaizhi Qian, Lie Lu, Chuang Gan
2024ICMLSpeech Self-Supervised Learning Using Diffusion Model Synthetic Data.Heting Gao, Kaizhi Qian, Junrui Ni, Chuang Gan, Mark A. Hasegawa-Johnson, Shiyu Chang, Yang Zhang
2024ICMLDecomposing Uncertainty for Large Language Models through Input Clarification Ensembling.Bairu Hou, Yujian Liu, Kaizhi Qian, Jacob Andreas, Shiyu Chang, Yang Zhang
2023CVPRPhysics-Driven Diffusion Models for Impact Sound Synthesis from Videos.Kun Su, Kaizhi Qian, Eli Shlizerman, Antonio Torralba, Chuang Gan
2023ICMLMaster-ASR: Achieving Multilingual Scalability and Low-Resource Adaptation in ASR with Modular Learning.Zhongzhi Yu, Yang Zhang, Kaizhi Qian, Cheng Wan, Yonggan Fu, Yongan Zhang, Yingyan Celine Lin
2022ICASSPSpeechSplit2.0: Unsupervised Speech Disentanglement for Voice Conversion without Tuning Autoencoder Bottlenecks.Chak Ho Chan, Kaizhi Qian, Yang Zhang, Mark Hasegawa-Johnson
2022ICASSPOn the Interplay between Sparsity, Naturalness, Intelligibility, and Prosody in Speech Synthesis.Cheng-I Jeff Lai, Erica Cooper, Yang Zhang, Shiyu Chang, Kaizhi Qian, Yi-Lun Liao, Yung-Sung Chuang, Alexander H. Liu, Junichi Yamagishi, David D. Cox, James R. Glass
2022ICMLContentVec: An Improved Self-Supervised Speech Representation by Disentangling Speakers.Kaizhi Qian, Yang Zhang, Heting Gao, Junrui Ni, Cheng-I Lai, David D. Cox, Mark Hasegawa-Johnson, Shiyu Chang
2022InterspeechWavPrompt: Towards Few-Shot Spoken Language Understanding with Frozen Language Models.Heting Gao, Junrui Ni, Kaizhi Qian, Yang Zhang, Shiyu Chang, Mark Hasegawa-Johnson
2022InterspeechUnsupervised Text-to-Speech Synthesis by Unsupervised Automatic Speech Recognition.Junrui Ni, Liming Wang, Heting Gao, Kaizhi Qian, Yang Zhang, Shiyu Chang, Mark Hasegawa-Johnson
2021ICASSPContinuous Cnn For Nonuniform Time Series.Hui Shi, Yang Zhang, Hao Wu, Shiyu Chang, Kaizhi Qian, Mark Hasegawa-Johnson, Jishen Zhao
2021ICMLGlobal Prosody Style Transfer Without Text Transcriptions.Kaizhi Qian, Yang Zhang, Shiyu Chang, Jinjun Xiong, Chuang Gan, David D. Cox, Mark Hasegawa-Johnson
2021InterspeechZero-Shot Cross-Lingual Phonetic Recognition with External Language Embedding.Heting Gao, Junrui Ni, Yang Zhang, Kaizhi Qian, Shiyu Chang, Mark Hasegawa-Johnson
2021InterspeechSpeech Denoising with Auditory Models.Mark R. Saddler, Andrew Francl, Jenelle Feather, Kaizhi Qian, Yang Zhang, Josh H. McDermott
2020ICASSPF0-Consistent Many-To-Many Non-Parallel Voice Conversion Via Conditional Autoencoder.Kaizhi Qian, Zeyu Jin, Mark Hasegawa-Johnson, Gautham J. Mysore
2020ICMLUnsupervised Speech Decomposition via Triple Information Bottleneck.Kaizhi Qian, Yang Zhang, Shiyu Chang, Mark Hasegawa-Johnson, David D. Cox
2019ICMLAutoVC: Zero-Shot Voice Style Transfer with Only Autoencoder Loss.Kaizhi Qian, Yang Zhang, Shiyu Chang, Xuesong Yang, Mark Hasegawa-Johnson
2018ICASSPDeep Learning Based Speech Beamforming.Kaizhi Qian, Yang Zhang, Shiyu Chang, Xuesong Yang, Dinei A. F. Florncio, Mark Hasegawa-Johnson
2017InterspeechSpeech Enhancement Using Bayesian Wavenet.Kaizhi Qian, Yang Zhang, Shiyu Chang, Xuesong Yang, Dinei Florncio, Mark Hasegawa-Johnson