Huadai Liu
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
13
Venues
7
Active years
2023–2026
Best venue rank
A*
Where they publish
Papers
13 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | Masked Text-to-Audio Flow-Matching and Reward Feedback Optimization. | Rongjie Huang, Dongchao Yang, Wenxiang Guo, Huadai Liu, Xize Cheng, Zehan Wang, Zhou Zhao, Xixin Wu, Helen M. Meng |
| 2025 | ACL | FlashAudio: Rectified Flow for Fast and High-Fidelity Text-to-Audio Generation. | Huadai Liu, Jialei Wang, Rongjie Huang, Yang Liu, Heng Lu, Zhou Zhao, Wei Xue |
| 2025 | ICASSP | Fast Adaptation of Pretrained Speaker Verification System for Source Speaker Tracking. | Xiang Lyu, Yuxuan Wang, Tianyu Zhao, Huadai Liu |
| 2025 | ICASSP | Build LLM-Based Zero-Shot Streaming TTS System with Cosyvoice. | Xiang Lyu, Yuxuan Wang, Tianyu Zhao, Hao Wang, Huadai Liu, Zhihao Du |
| 2025 | ICLR | Both Ears Wide Open: Towards Language-Driven Spatial Audio Generation. | Peiwen Sun, Sitong Cheng, Xiangtai Li, Zhen Ye, Huadai Liu, Honggang Zhang, Wei Xue, Yike Guo |
| 2025 | ICML | OmniAudio: Generating Spatial Audio from 360-Degree Video. | Huadai Liu, Tianyi Luo, Kaicheng Luo, Qikai Jiang, Peiwen Sun, Jialei Wang, Rongjie Huang, Qian Chen, Wen Wang, Xiangtai Li, Shiliang Zhang, Zhijie Yan, Zhou Zhao, Wei Xue |
| 2024 | ACL | Wav2SQL: Direct Generalizable Speech-To-SQL Parsing. | Huadai Liu, Rongjie Huang, Jinzheng He, Gang Sun, Ran Shen, Xize Cheng, Zhou Zhao |
| 2024 | COLING | AntCritic: Argument Mining for Free-Form and Visually-Rich Financial Comments. | Huadai Liu, Wenqiang Xu, Xuan Lin, Jingjing Huo, Hong Chen, Zhou Zhao |
| 2023 | ACL | RMSSinger: Realistic-Music-Score based Singing Voice Synthesis. | Jinzheng He, Jinglin Liu, Zhenhui Ye, Rongjie Huang, Chenye Cui, Huadai Liu, Zhou Zhao |
| 2023 | ACL | AV-TranSpeech: Audio-Visual Robust Speech-to-Speech Translation. | Rongjie Huang, Huadai Liu, Xize Cheng, Yi Ren, Linjun Li, Zhenhui Ye, Jinzheng He, Lichao Zhang, Jinglin Liu, Xiang Yin, Zhou Zhao |
| 2023 | EMNLP | ViT-TTS: Visual Text-to-Speech with Scalable Diffusion Transformer. | Huadai Liu, Rongjie Huang, Xuan Lin, Wenqiang Xu, Maozong Zheng, Hong Chen, Jinzheng He, Zhou Zhao |
| 2023 | ICCV | MixSpeech: Cross-Modality Self-Learning with Audio-Visual Stream Mixup for Visual Speech Translation and Recognition. | Xize Cheng, Tao Jin, Rongjie Huang, Linjun Li, Wang Lin, Zehan Wang, Ye Wang, Huadai Liu, Aoxiong Yin, Zhou Zhao |
| 2023 | ICLR | TranSpeech: Speech-to-Speech Translation With Bilateral Perturbation. | Rongjie Huang, Jinglin Liu, Huadai Liu, Yi Ren, Lichao Zhang, Jinzheng He, Zhou Zhao |