| 2025 | ICASSP | Get Large Language Models Ready to Speak: A Late-fusion Approach for Speech Generation. | Maohao Shen, Shun Zhang, Jilong Wu, Zhiping Xiu, Ehab A. AlBadawy, Yiting Lu, Mike Seltzer, Qing He |
| 2023 | ICASSP | Self-Supervised Representations for Singing Voice Conversion. | Tejas Jayashankar, Jilong Wu, Leda Sari, David Kant, Vimal Manohar, Qing He |
| 2023 | ICASSP | Voice-Preserving Zero-Shot Multiple Accent Conversion. | Mumin Jin, Prashant Serai, Jilong Wu, Andros Tjandra, Vimal Manohar, Qing He |
| 2022 | ICASSP | Vocbench: A Neural Vocoder Benchmark for Speech Synthesis. | Ehab A. AlBadawy, Andrew Gibiansky, Qing He, Jilong Wu, Ming-Ching Chang, Siwei Lyu |
| 2022 | ICASSP | Architecture for Variable Bitrate Neural Speech Codec with Configurable Computation Complexity. | Tejas Jayashankar, Thilo Khler, Kaustubh Kalgaonkar, Zhiping Xiu, Jilong Wu, Ju Lin, Prabhav Agrawal, Qing He |
| 2022 | ICASSP | Multilingual Text-To-Speech Training Using Cross Language Voice Conversion And Self-Supervised Learning Of Speech Representations. | Jilong Wu, Adam Polyak, Yaniv Taigman, Jason Fong, Prabhav Agrawal, Qing He |
| 2021 | ICASSP | Multi-Rate Attention Architecture for Fast Streamable Text-to-Speech Spectrum Modeling. | Qing He, Zhiping Xiu, Thilo Khler, Jilong Wu |