| 2026 | AAAI | Inference-time Scaling for Diffusion-based Audio Super-resolution. | Yizhu Jin, Zhen Ye, Zeyue Tian, Haohe Liu, Qiuqiang Kong, Yike Guo, Wei Xue |
| 2026 | ACL | FineLAP: Taming Heterogeneous Supervision for Fine-grained Language-Audio Pretraining. | Xiquan Li, Xuenan Xu, Ziyang Ma, Wenxi Chen, Haolin He, Qiuqiang Kong, Xie Chen |
| 2025 | AAAI | Codec Does Matter: Exploring the Semantic Shortcoming of Codec for Audio Language Model. | Zhen Ye, Peiwen Sun, Jiahe Lei, Hongzhan Lin, Xu Tan, Zheqi Dai, Qiuqiang Kong, Jianyi Chen, Jiahao Pan, Qifeng Liu, Yike Guo, Wei Xue |
| 2025 | ICASSP | Musimple: A Simplified Music Generation System with Diffusion Transformer. | Zheqi Dai, Haolin He, Qiuqiang Kong |
| 2025 | ICASSP | DRCap: Decoding CLAP Latents with Retrieval-Augmented Generation for Zero-shot Audio Captioning. | Xiquan Li, Wenxi Chen, Ziyang Ma, Xuenan Xu, Yuzhe Liang, Zhisheng Zheng, Qiuqiang Kong, Xie Chen |
| 2025 | ICASSP | Piano Transcription by Hierarchical Language Modeling with Pretrained Roll-based Encoders. | Dichucheng Li, Yongyi Zang, Qiuqiang Kong |
| 2025 | ICASSP | Language-Queried Target Sound Extraction Without Parallel Training Data. | Hao Ma, Zhiyuan Peng, Xu Li, Yukai Li, Mingjie Shao, Qiuqiang Kong, Ju Liu |
| 2025 | ICASSP | PAWS: A Physical Acoustic Wave Simulation Dataset for Sound Modeling and Rendering. | Tianming Yin, Yiyang Zhou, Xuzhou Ye, Qiuqiang Kong |
| 2025 | IJCNN | QueryNILM: Query based Non-Intrusive Load Monitoring with Appliance Embeddings. | Shijie Yang, Jie Jiang, Yichen Zhang, Qiuqiang Kong, Qianwen Cao |
| 2025 | Interspeech | DiffStereo: End-to-End Mono-to-Stereo Audio Generation with Diffusion Transformer. | Suqi Zhang, Zheqi Dai, Yongyi Zang, Yin Cao, Qiuqiang Kong |
| 2025 | MMSP | Music Source Restoration. | Yongyi Zang, Zheqi Dai, Mark D. Plumbley, Qiuqiang Kong |
| 2024 | AAAI | Learning Temporal Resolution in Spectrogram for Audio Classification. | Haohe Liu, Xubo Liu, Qiuqiang Kong, Wenwu Wang, Mark D. Plumbley |
| 2024 | ADMA | Intra and Inter-User Data Augmentation Methods for Energy Disaggregation. | Shijie Yang, Jie Jiang, Qiuqiang Kong |
| 2024 | ICASSP | Joint Music and Language Attention Models for Zero-Shot Music Tagging. | Xingjian Du, Zhesong Yu, Jiaju Lin, Bilei Zhu, Qiuqiang Kong |
| 2024 | ICASSP | Mertech: Instrument Playing Technique Detection Using Self-Supervised Pretrained Model with Multi-Task Finetuning. | Dichucheng Li, Yinghao Ma, Weixing Wei, Qiuqiang Kong, Yulun Wu, Mingjin Che, Fan Xia, Emmanouil Benetos, Wei Li |
| 2024 | ICASSP | Music Source Separation With Band-Split Rope Transformer. | Wei Tsung Lu, Ju-Chiang Wang, Qiuqiang Kong, Yun-Ning Hung |
| 2024 | ICASSP | A Unified Front-End Framework for English Text-to-Speech Synthesis. | Zelin Ying, Chen Li, Yu Dong, Qiuqiang Kong, Qiao Tian, Yuanyuan Huo, Yuxuan Wang |
| 2023 | ICASSP | Streaming Voice Conversion via Intermediate Bottleneck Features and Non-Streaming Teacher Guidance. | Yuanzhe Chen, Ming Tu, Tang Li, Xin Li, Qiuqiang Kong, Jiaxin Li, Zhichao Wang, Qiao Tian, Yuping Wang, Yuxuan Wang |
| 2023 | ICASSP | Simple Pooling Front-Ends for Efficient Audio Classification. | Xubo Liu, Haohe Liu, Qiuqiang Kong, Xinhao Mei, Mark D. Plumbley, Wenwu Wang |
| 2023 | Interspeech | Visually-Aware Audio Captioning With Adaptive Audio-Visual Attention. | Xubo Liu, Qiushi Huang, Xinhao Mei, Haohe Liu, Qiuqiang Kong, Jianyuan Sun, Shengchen Li, Tom Ko, Yu Zhang, H. Lilian Tang, Mark D. Plumbley, Volkan Kili, Wenwu Wang |
| 2023 | Interspeech | Ontology-aware Learning and Evaluation for Audio Tagging. | Haohe Liu, Qiuqiang Kong, Xubo Liu, Xinhao Mei, Wenwu Wang, Mark D. Plumbley |
| 2022 | ICASSP | A Track-Wise Ensemble Event Independent Network for Polyphonic Sound Event Localization and Detection. | Jinbo Hu, Yin Cao, Ming Wu, Qiuqiang Kong, Feiran Yang, Mark D. Plumbley, Jun Yang |
| 2022 | Interspeech | Neural Vocoder is All You Need for Speech Super-resolution. | Haohe Liu, Woosung Choi, Xubo Liu, Qiuqiang Kong, Qiao Tian, DeLiang Wang |
| 2022 | Interspeech | Separate What You Describe: Language-Queried Audio Source Separation. | Xubo Liu, Haohe Liu, Qiuqiang Kong, Xinhao Mei, Jinzheng Zhao, Qiushi Huang, Mark D. Plumbley, Wenwu Wang |
| 2022 | Interspeech | VoiceFixer: A Unified Framework for High-Fidelity Speech Restoration. | Haohe Liu, Xubo Liu, Qiuqiang Kong, Qiao Tian, Yan Zhao, DeLiang Wang, Chuanzeng Huang, Yuxuan Wang |
| 2021 | ICASSP | An Improved Event-Independent Network for Polyphonic Sound Event Localization and Detection. | Yin Cao, Turab Iqbal, Qiuqiang Kong, Fengyan An, Wenwu Wang, Mark D. Plumbley |
| 2021 | ICASSP | Singing Melody Extraction from Polyphonic Music based on Spectral Correlation Modeling. | Xingjian Du, Bilei Zhu, Qiuqiang Kong, Zejun Ma |
| 2021 | Interspeech | Speech Enhancement with Weakly Labelled Data from AudioSet. | Qiuqiang Kong, Haohe Liu, Xingjian Du, Li Chen, Rui Xia, Yuxuan Wang |
| 2020 | ICASSP | Learning With Out-of-Distribution Data for Audio Classification. | Turab Iqbal, Yin Cao, Qiuqiang Kong, Mark D. Plumbley, Wenwu Wang |
| 2020 | ICASSP | Source Separation with Weakly Labelled Data: an Approach to Computational Auditory Scene Analysis. | Qiuqiang Kong, Yuxuan Wang, Xuchen Song, Yin Cao, Wenwu Wang, Mark D. Plumbley |
| 2019 | ICASSP | Sound Event Detection with Sequentially Labelled Data Based on Connectionist Temporal Classification and Unsupervised Clustering. | Yuanbo Hou, Qiuqiang Kong, Shengchen Li, Mark D. Plumbley |
| 2019 | ICASSP | Acoustic Scene Generation with Conditional Samplernn. | Qiuqiang Kong, Yong Xu, Turab Iqbal, Yin Cao, Wenwu Wang, Mark D. Plumbley |
| 2019 | ICASSP | Attention-based Atrous Convolutional Neural Networks: Visualisation and Understanding Perspectives of Acoustic Scenes. | Zhao Ren, Qiuqiang Kong, Jing Han, Mark D. Plumbley, Bjrn W. Schuller |
| 2019 | ICASSP | Divergence Based Weighting for Information Channels in Deep Convolutional Neural Networks for Bird Audio Detection. | Cemre Zor, Muhammad Awais, Josef Kittler, Miroslaw Bober, Sameed Husain, Qiuqiang Kong, Christian Kroos |
| 2019 | IJCAI | Single-Channel Signal Separation and Deconvolution with Generative Adversarial Networks. | Qiuqiang Kong, Yong Xu, Philip J. B. Jackson, Wenwu Wang, Mark D. Plumbley |
| 2018 | ICASSP | Large-Scale Weakly Supervised Audio Classification Using Gated Convolutional Neural Network. | Yong Xu, Qiuqiang Kong, Wenwu Wang, Mark D. Plumbley |
| 2018 | ICASSP | Audio Set Classification with Attention Model: A Probabilistic Perspective. | Qiuqiang Kong, Yong Xu, Wenwu Wang, Mark D. Plumbley |
| 2018 | ICASSP | A Joint Separation-Classification Model for Sound Event Detection of Weakly Labelled Data. | Qiuqiang Kong, Yong Xu, Wenwu Wang, Mark D. Plumbley |
| 2017 | ICASSP | A joint detection-classification model for audio tagging of weakly labelled data. | Qiuqiang Kong, Yong Xu, Wenwu Wang, Mark D. Plumbley |
| 2017 | IJCNN | Convolutional gated recurrent neural network incorporating spatial features for audio tagging. | Yong Xu, Qiuqiang Kong, Qiang Huang, Wenwu Wang, Mark D. Plumbley |
| 2017 | Interspeech | Attention and Localization Based on a Deep Convolutional Recurrent Model for Weakly Supervised Audio Tagging. | Yong Xu, Qiuqiang Kong, Qiang Huang, Wenwu Wang, Mark D. Plumbley |