| 2025 | Interspeech | Face2VoiceSync: Lightweight Face-Voice Consistency for Text-Driven Talking Face Generation. | Fang Kang, Yin Cao, Haoyu Chen |
| 2025 | Interspeech | DiffStereo: End-to-End Mono-to-Stereo Audio Generation with Diffusion Transformer. | Suqi Zhang, Zheqi Dai, Yongyi Zang, Yin Cao, Qiuqiang Kong |
| 2022 | ICASSP | A Track-Wise Ensemble Event Independent Network for Polyphonic Sound Event Localization and Detection. | Jinbo Hu, Yin Cao, Ming Wu, Qiuqiang Kong, Feiran Yang, Mark D. Plumbley, Jun Yang |
| 2021 | ICASSP | An Improved Event-Independent Network for Polyphonic Sound Event Localization and Detection. | Yin Cao, Turab Iqbal, Qiuqiang Kong, Fengyan An, Wenwu Wang, Mark D. Plumbley |
| 2020 | ICASSP | Learning With Out-of-Distribution Data for Audio Classification. | Turab Iqbal, Yin Cao, Qiuqiang Kong, Mark D. Plumbley, Wenwu Wang |
| 2020 | ICASSP | Source Separation with Weakly Labelled Data: an Approach to Computational Auditory Scene Analysis. | Qiuqiang Kong, Yuxuan Wang, Xuchen Song, Yin Cao, Wenwu Wang, Mark D. Plumbley |
| 2019 | ICASSP | Acoustic Scene Generation with Conditional Samplernn. | Qiuqiang Kong, Yong Xu, Turab Iqbal, Yin Cao, Wenwu Wang, Mark D. Plumbley |
| 2019 | ICASSP | Generalisation in Environmental Sound Classification: The 'Making Sense of Sounds' Data Set and Challenge. | Christian Kroos, Oliver Bones, Yin Cao, Lara Harris, Philip J. B. Jackson, William J. Davies, Wenwu Wang, Trevor J. Cox, Mark D. Plumbley |
| 2014 | HCI | Gestures: The Reformer of the User's Mental Model in Mobile HCI. | Tian Lei, Luyao Xiong, Kun Chen, Xu Liu, Yin Cao, Qi Zhang, Dongyuan Liu, Sisi Guo |