Kaizhi Qian
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
21
Venues
7
Active years
2017–2025
Best venue rank
A*
Where they publish
Papers
21 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | AAAI | UniMuMo: Unified Text, Music, and Motion Generation. | Han Yang, Kun Su, Yutong Zhang, Jiaben Chen, Kaizhi Qian, Gaowen Liu, Chuang Gan |
| 2025 | ACL | PLAY2PROMPT: Zero-shot Tool Instruction Optimization for LLM Agents via Tool Play. | Wei Fang, Yang Zhang, Kaizhi Qian, James R. Glass, Yada Zhu |
| 2025 | ICCV | RapVerse: Coherent Vocals and Whole-Body Motion Generation from Text. | Jiaben Chen, Xin Yan, Yihang Chen, Siyuan Cen, Zixin Wang, Qinwei Ma, Haoyu Zhen, Kaizhi Qian, Lie Lu, Chuang Gan |
| 2024 | ICML | Speech Self-Supervised Learning Using Diffusion Model Synthetic Data. | Heting Gao, Kaizhi Qian, Junrui Ni, Chuang Gan, Mark A. Hasegawa-Johnson, Shiyu Chang, Yang Zhang |
| 2024 | ICML | Decomposing Uncertainty for Large Language Models through Input Clarification Ensembling. | Bairu Hou, Yujian Liu, Kaizhi Qian, Jacob Andreas, Shiyu Chang, Yang Zhang |
| 2023 | CVPR | Physics-Driven Diffusion Models for Impact Sound Synthesis from Videos. | Kun Su, Kaizhi Qian, Eli Shlizerman, Antonio Torralba, Chuang Gan |
| 2023 | ICML | Master-ASR: Achieving Multilingual Scalability and Low-Resource Adaptation in ASR with Modular Learning. | Zhongzhi Yu, Yang Zhang, Kaizhi Qian, Cheng Wan, Yonggan Fu, Yongan Zhang, Yingyan Celine Lin |
| 2022 | ICASSP | SpeechSplit2.0: Unsupervised Speech Disentanglement for Voice Conversion without Tuning Autoencoder Bottlenecks. | Chak Ho Chan, Kaizhi Qian, Yang Zhang, Mark Hasegawa-Johnson |
| 2022 | ICASSP | On the Interplay between Sparsity, Naturalness, Intelligibility, and Prosody in Speech Synthesis. | Cheng-I Jeff Lai, Erica Cooper, Yang Zhang, Shiyu Chang, Kaizhi Qian, Yi-Lun Liao, Yung-Sung Chuang, Alexander H. Liu, Junichi Yamagishi, David D. Cox, James R. Glass |
| 2022 | ICML | ContentVec: An Improved Self-Supervised Speech Representation by Disentangling Speakers. | Kaizhi Qian, Yang Zhang, Heting Gao, Junrui Ni, Cheng-I Lai, David D. Cox, Mark Hasegawa-Johnson, Shiyu Chang |
| 2022 | Interspeech | WavPrompt: Towards Few-Shot Spoken Language Understanding with Frozen Language Models. | Heting Gao, Junrui Ni, Kaizhi Qian, Yang Zhang, Shiyu Chang, Mark Hasegawa-Johnson |
| 2022 | Interspeech | Unsupervised Text-to-Speech Synthesis by Unsupervised Automatic Speech Recognition. | Junrui Ni, Liming Wang, Heting Gao, Kaizhi Qian, Yang Zhang, Shiyu Chang, Mark Hasegawa-Johnson |
| 2021 | ICASSP | Continuous Cnn For Nonuniform Time Series. | Hui Shi, Yang Zhang, Hao Wu, Shiyu Chang, Kaizhi Qian, Mark Hasegawa-Johnson, Jishen Zhao |
| 2021 | ICML | Global Prosody Style Transfer Without Text Transcriptions. | Kaizhi Qian, Yang Zhang, Shiyu Chang, Jinjun Xiong, Chuang Gan, David D. Cox, Mark Hasegawa-Johnson |
| 2021 | Interspeech | Zero-Shot Cross-Lingual Phonetic Recognition with External Language Embedding. | Heting Gao, Junrui Ni, Yang Zhang, Kaizhi Qian, Shiyu Chang, Mark Hasegawa-Johnson |
| 2021 | Interspeech | Speech Denoising with Auditory Models. | Mark R. Saddler, Andrew Francl, Jenelle Feather, Kaizhi Qian, Yang Zhang, Josh H. McDermott |
| 2020 | ICASSP | F0-Consistent Many-To-Many Non-Parallel Voice Conversion Via Conditional Autoencoder. | Kaizhi Qian, Zeyu Jin, Mark Hasegawa-Johnson, Gautham J. Mysore |
| 2020 | ICML | Unsupervised Speech Decomposition via Triple Information Bottleneck. | Kaizhi Qian, Yang Zhang, Shiyu Chang, Mark Hasegawa-Johnson, David D. Cox |
| 2019 | ICML | AutoVC: Zero-Shot Voice Style Transfer with Only Autoencoder Loss. | Kaizhi Qian, Yang Zhang, Shiyu Chang, Xuesong Yang, Mark Hasegawa-Johnson |
| 2018 | ICASSP | Deep Learning Based Speech Beamforming. | Kaizhi Qian, Yang Zhang, Shiyu Chang, Xuesong Yang, Dinei A. F. Florncio, Mark Hasegawa-Johnson |
| 2017 | Interspeech | Speech Enhancement Using Bayesian Wavenet. | Kaizhi Qian, Yang Zhang, Shiyu Chang, Xuesong Yang, Dinei Florncio, Mark Hasegawa-Johnson |