| 2025 | ICASSP | Piano Transcription by Hierarchical Language Modeling with Pretrained Roll-based Encoders. | Dichucheng Li, Yongyi Zang, Qiuqiang Kong |
| 2025 | Interspeech | DiffStereo: End-to-End Mono-to-Stereo Audio Generation with Diffusion Transformer. | Suqi Zhang, Zheqi Dai, Yongyi Zang, Yin Cao, Qiuqiang Kong |
| 2025 | MMSP | Music Source Restoration. | Yongyi Zang, Zheqi Dai, Mark D. Plumbley, Qiuqiang Kong |
| 2024 | ICASSP | SingFake: Singing Voice Deepfake Detection. | Yongyi Zang, You Zhang, Mojtaba Heydari, Zhiyao Duan |
| 2024 | ICASSP | SynthTab: Leveraging Synthesized Data for Guitar Tablature Transcription. | Yongyi Zang, Yi Zhong, Frank Cwitkowitz, Zhiyao Duan |
| 2024 | Interspeech | CtrSVDD: A Benchmark Dataset and Baseline Analysis for Controlled Singing Voice Deepfake Detection. | Yongyi Zang, Jiatong Shi, You Zhang, Ryuichi Yamamoto, Jionghao Han, Yuxun Tang, Shengyuan Xu, Wenxiao Zhao, Jing Guo, Tomoki Toda, Zhiyao Duan |
| 2023 | Interspeech | Phase perturbation improves channel robustness for speech spoofing countermeasures. | Yongyi Zang, You Zhang, Zhiyao Duan |