| 2025 | AAAI | SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor. | Chenyu Yang, Shuai Wang, Hangting Chen, Jianwei Yu, Wei Tan, Rongzhi Gu, Yaoxun Xu, Yizhi Zhou, Haina Zhu, Haizhou Li |
| 2025 | Interspeech | WAKE: Watermarking Audio with Key Enrichment. | Yaoxun Xu, Jianwei Yu, Hangting Chen, Zhiyong Wu, Xixin Wu, Dong Yu, Rongzhi Gu, Yi Luo |
| 2024 | AAAI | SECap: Speech Emotion Captioning with Large Language Model. | Yaoxun Xu, Hangting Chen, Jianwei Yu, Qiaochu Huang, Zhiyong Wu, Shi-Xiong Zhang, Guangzhi Li, Yi Luo, Rongzhi Gu |
| 2024 | ICASSP | Improving Music Source Separation with Simo Stereo Band-Split Rnn. | Yi Luo, Rongzhi Gu |
| 2024 | ICASSP | A Unified Geometry-Aware Source Localization and Separation Framework for AD-HOC Microphone Array. | Jingjie Fan, Rongzhi Gu, Yi Luo, Cong Pang |
| 2024 | ICASSP | Fast Random Approximation of Multi-Channel Room Impulse Response. | Yi Luo, Rongzhi Gu |
| 2023 | ICASSP | Parameter-Efficient Transfer Learning of Pre-Trained Transformer Models for Speaker Verification Using Adapters. | Junyi Peng, Themos Stafylakis, Rongzhi Gu, Oldrich Plchot, Ladislav Mosner, Luks Burget, Jan Cernock |
| 2023 | ICASSP | TSpeech-AI System Description to the 5th Deep Noise Suppression (DNS) Challenge. | Jianwei Yu, Hangting Chen, Yi Luo, Rongzhi Gu, Weihua Li, Chao Weng |
| 2023 | Interspeech | Ultra Dual-Path Compression For Joint Echo Cancellation And Noise Suppression. | Hangting Chen, Jianwei Yu, Yi Luo, Rongzhi Gu, Weihua Li, Zhuocheng Lu, Chao Weng |
| 2023 | Interspeech | High Fidelity Speech Enhancement with Band-split RNN. | Jianwei Yu, Hangting Chen, Yi Luo, Rongzhi Gu, Chao Weng |
| 2022 | ICASSP | Learning Decoupling Features Through Orthogonality Regularization. | Li Wang, Rongzhi Gu, Weiji Zhuang, Peng Gao, Yujun Wang, Yuexian Zou |
| 2022 | ICASSP | Improving Dual-Microphone Speech Enhancement by Learning Cross-Channel Features with Multi-Head Attention. | Xinmeng Xu, Rongzhi Gu, Yuexian Zou |
| 2022 | Interspeech | Learnable Sparse Filterbank for Speaker Verification. | Junyi Peng, Rongzhi Gu, Ladislav Mosner, Oldrich Plchot, Luks Burget, Jan Cernock |
| 2022 | Interspeech | Speaker-Aware Mixture of Mixtures Training for Weakly Supervised Speaker Extraction. | Zifeng Zhao, Rongzhi Gu, Dongchao Yang, Jinchuan Tian, Yuexian Zou |
| 2022 | Interspeech | Target Confusion in End-to-end Speaker Extraction: Analysis and Approaches. | Zifeng Zhao, Dongchao Yang, Rongzhi Gu, Haoran Zhang, Yuexian Zou |
| 2021 | ASRU | 3D Spatial Features for Multi-Channel Target Speech Separation. | Rongzhi Gu, Shi-Xiong Zhang, Meng Yu, Dong Yu |
| 2021 | Interspeech | Effective Phase Encoding for End-To-End Speaker Verification. | Junyi Peng, Xiaoyang Qu, Rongzhi Gu, Jianzong Wang, Jing Xiao, Luks Burget, Jan Cernock |
| 2021 | Interspeech | ICSpk: Interpretable Complex Speaker Embedding Extractor from Raw Waveform. | Junyi Peng, Xiaoyang Qu, Jianzong Wang, Rongzhi Gu, Jing Xiao, Luks Burget, Jan Cernock |
| 2021 | Interspeech | Text Anchor Based Metric Learning for Small-Footprint Keyword Spotting. | Li Wang, Rongzhi Gu, Nuo Chen, Yuexian Zou |
| 2020 | ICASSP | Enhancing End-to-End Multi-Channel Speech Separation Via Spatial Feature Learning. | Rongzhi Gu, Shi-Xiong Zhang, Lianwu Chen, Yong Xu, Meng Yu, Dan Su, Yuexian Zou, Dong Yu |
| 2020 | Interspeech | Deep Speaker Embedding with Long Short Term Centroid Learning for Text-Independent Speaker Verification. | Junyi Peng, Rongzhi Gu, Yuexian Zou |
| 2020 | Interspeech | Audio-Visual Multi-Channel Recognition of Overlapped Speech. | Jianwei Yu, Bo Wu, Rongzhi Gu, Shi-Xiong Zhang, Lianwu Chen, Yong Xu, Meng Yu, Dan Su, Dong Yu, Xunying Liu, Helen Meng |
| 2019 | ASRU | Logistic Similarity Metric Learning via Affinity Matrix for Text-Independent Speaker Verification. | Junyi Peng, Rongzhi Gu, Yuexian Zou |
| 2019 | Interspeech | A Comprehensive Study of Speech Separation: Spectrogram vs Waveform Separation. | Fahimeh Bahmaninezhad, Jian Wu, Rongzhi Gu, Shi-Xiong Zhang, Yong Xu, Meng Yu, Dong Yu |
| 2019 | Interspeech | Neural Spatial Filter: Target Speaker Speech Separation Assisted with Directional Information. | Rongzhi Gu, Lianwu Chen, Shi-Xiong Zhang, Jimeng Zheng, Yong Xu, Meng Yu, Dan Su, Yuexian Zou, Dong Yu |