| 2025 | ACL | SpeechT-RAG: Reliable Depression Detection in LLMs with Retrieval-Augmented Generation Using Speech Timing Information. | Xiangyu Zhang, Hexin Liu, Qiquan Zhang, Beena Ahmed, Julien Epps |
| 2025 | ICASSP | Time-Graph Frequency Representation with Singular Value Decomposition for Neural Speech Enhancement. | Tingting Wang, Tianrui Wang, Meng Ge, Qiquan Zhang, Zirui Ge, Zhen Yang |
| 2024 | EMNLP | Speaking in Wavelet Domain: A Simple and Efficient Approach to Speed up Speech Diffusion Model. | Xiangyu Zhang, Daijiao Liu, Hexin Liu, Qiquan Zhang, Hanyu Meng, Leibny Paola Garca-Perera, Engsiong Chng, Lina Yao |
| 2024 | EMNLP | When LLMs Meets Acoustic Landmarks: An Efficient Approach to Integrate Speech into Large Language Models for Depression Detection. | Xiangyu Zhang, Hexin Liu, Kaishuai Xu, Qiquan Zhang, Daijiao Liu, Beena Ahmed, Julien Epps |
| 2024 | ICASSP | GLMB 3D Speaker Tracking with Video-Assisted Multi-Channel Audio Optimization Functions. | Xinyuan Qian, Zexu Pan, Qiquan Zhang, Kainan Chen, Shoufeng Lin |
| 2024 | ICASSP | An Empirical Study on the Impact of Positional Encoding in Transformer-Based Monaural Speech Enhancement. | Qiquan Zhang, Meng Ge, Hongxu Zhu, Eliathamby Ambikairajah, Qi Song, Zhaoheng Ni, Haizhou Li |
| 2024 | Interspeech | Binaural Selective Attention Model for Target Speaker Extraction. | Hanyu Meng, Qiquan Zhang, Xiangyu Zhang, Vidhyasaharan Sethu, Eliathamby Ambikairajah |
| 2024 | Interspeech | An Exploration of Length Generalization in Transformer-Based Speech Enhancement. | Qiquan Zhang, Hongxu Zhu, Xinyuan Qian, Eliathamby Ambikairajah, Haizhou Li |
| 2023 | ICASSP | Ripple Sparse Self-Attention for Monaural Speech Enhancement. | Qiquan Zhang, Hongxu Zhu, Qi Song, Xinyuan Qian, Zhaoheng Ni, Haizhou Li |
| 2022 | EMNLP | FineD-Eval: Fine-grained Automatic Dialogue-Level Evaluation. | Chen Zhang, Luis Fernando D'Haro, Qiquan Zhang, Thomas Friedrichs, Haizhou Li |
| 2022 | ICASSP | Time-Frequency Attention for Monaural Speech Enhancement. | Qiquan Zhang, Qi Song, Zhaoheng Ni, Aaron Nicolson, Haizhou Li |
| 2021 | Interspeech | Temporal Convolutional Network with Frequency Dimension Adaptive Attention for Speech Enhancement. | Qiquan Zhang, Qi Song, Aaron Nicolson, Tian Lan, Haizhou Li |