| 2026 | AAAI | DualSpeechLM: Towards Unified Speech Understanding and Generation via Dual Speech Token Modeling with Large Language Models. | Yuanyuan Wang, Dongchao Yang, Yiwen Shao, Hangting Chen, Jiankun Zhao, Zhiyong Wu, Helen Meng, Xixin Wu |
| 2025 | AAAI | SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor. | Chenyu Yang, Shuai Wang, Hangting Chen, Jianwei Yu, Wei Tan, Rongzhi Gu, Yaoxun Xu, Yizhi Zhou, Haina Zhu, Haizhou Li |
| 2025 | ICASSP | AudioComposer: Towards Fine-grained Audio Generation with Natural Language Descriptions. | Yuanyuan Wang, Hangting Chen, Dongchao Yang, Zhiyong Wu, Xixin Wu |
| 2025 | Interspeech | TSDT-Net: Ultra-Low-Complexity Two-Stage Model Combining Dual-Path-Transformer and Transform-Average-Concatenate Network for Speech Enhancement. | Yi Gao, Hangting Chen, Siyu Zhang, Qingshan Yang, Jingcong Chen |
| 2025 | Interspeech | WAKE: Watermarking Audio with Key Enrichment. | Yaoxun Xu, Jianwei Yu, Hangting Chen, Zhiyong Wu, Xixin Wu, Dong Yu, Rongzhi Gu, Yi Luo |
| 2025 | Interspeech | TVC-MusicGen: Time-Varying Structure Control for Background Music Generation via Self-Supervised Training. | Chenyu Yang, Hangting Chen, Shuai Wang, Haina Zhu, Haizhou Li |
| 2024 | AAAI | SECap: Speech Emotion Captioning with Large Language Model. | Yaoxun Xu, Hangting Chen, Jianwei Yu, Qiaochu Huang, Zhiyong Wu, Shi-Xiong Zhang, Guangzhi Li, Yi Luo, Rongzhi Gu |
| 2024 | ICASSP | Complexity Scaling for Speech Denoising. | Hangting Chen, Jianwei Yu, Chao Weng |
| 2024 | ICASSP | Consistent and Relevant: Rethink the Query Embedding in General Sound Separation. | Yuanyuan Wang, Hangting Chen, Dongchao Yang, Jianwei Yu, Chao Weng, Zhiyong Wu, Helen Meng |
| 2024 | ICASSP | AutoPrep: An Automatic Preprocessing Framework for In-The-Wild Speech Data. | Jianwei Yu, Hangting Chen, Yanyao Bian, Xiang Li, Yi Luo, Jinchuan Tian, Mengyang Liu, Jiayi Jiang, Shuai Wang |
| 2024 | IJCNN | Continuous Target Speech Extraction: Enhancing Personalized Diarization and Extraction on Complex Recordings. | He Zhao, Hangting Chen, Jianwei Yu, Yuehai Wang |
| 2023 | ICASSP | TSpeech-AI System Description to the 5th Deep Noise Suppression (DNS) Challenge. | Jianwei Yu, Hangting Chen, Yi Luo, Rongzhi Gu, Weihua Li, Chao Weng |
| 2023 | Interspeech | Ultra Dual-Path Compression For Joint Echo Cancellation And Noise Suppression. | Hangting Chen, Jianwei Yu, Yi Luo, Rongzhi Gu, Weihua Li, Zhuocheng Lu, Chao Weng |
| 2023 | Interspeech | Bayes Risk Transducer: Transducer with Controllable Alignment Prediction. | Jinchuan Tian, Jianwei Yu, Hangting Chen, Brian Yan, Chao Weng, Dong Yu, Shinji Watanabe |
| 2023 | Interspeech | High Fidelity Speech Enhancement with Band-split RNN. | Jianwei Yu, Hangting Chen, Yi Luo, Rongzhi Gu, Chao Weng |
| 2022 | ICASSP | DPT-FSNet: Dual-Path Transformer Based Full-Band and Sub-Band Fusion Network for Speech Enhancement. | Feng Dang, Hangting Chen, Pengyuan Zhang |
| 2022 | Interspeech | Beam-Guided TasNet: An Iterative Speech Separation Framework with Multi-Channel Output. | Hangting Chen, Yi Yang, Feng Dang, Pengyuan Zhang |
| 2022 | Interspeech | The HCCL System for the NIST SRE21. | Zhuo Li, Runqiu Xiao, Hangting Chen, Zhenduo Zhao, Zihan Zhang, Wenchao Wang |
| 2021 | IJCNN | Power Pooling: An Adaptive Pooling Function for Weakly Labelled Sound Event Detection. | Yuzhuo Liu, Hangting Chen, Yun Wang, Pengyuan Zhang |
| 2021 | Interspeech | Improved Speech Enhancement Using a Complex-Domain GAN with Fused Time-Domain and Time-Frequency Domain Constraints. | Feng Dang, Pengyuan Zhang, Hangting Chen |
| 2020 | Interspeech | Improved Guided Source Separation Integrated with a Strong Back-End for the CHiME-6 Dinner Party Scenario. | Hangting Chen, Pengyuan Zhang, Qian Shi, Zuozhen Liu |
| 2019 | ICASSP | An Audio Scene Classification Framework with Embedded Filters and a DCT-based Temporal Module. | Hangting Chen, Pengyuan Zhang, Yonghong Yan |
| 2019 | Interspeech | Speaker-Invariant Feature-Mapping for Distant Speech Recognition via Adversarial Teacher-Student Learning. | Long Wu, Hangting Chen, Li Wang, Pengyuan Zhang, Yonghong Yan |
| 2018 | Interspeech | Deep Convolutional Neural Network with Scalogram for Audio Scene Modeling. | Hangting Chen, Pengyuan Zhang, Haichuan Bai, Qingsheng Yuan, Xiuguo Bao, Yonghong Yan |