| 2026 | ICDCS | Non-Redundant and Hotness-Aware Caching for Low-Latency Retrieval-Augmented Generation. | Zeyu Xie, Hongtao Wang, Yu-Ang Zhang, Peiquan Jin |
| 2025 | ICASSP | PicoAudio: Enabling Precise Temporal Controllability in Text-to-Audio Generation. | Zeyu Xie, Xuenan Xu, Zhizheng Wu, Mengyue Wu |
| 2025 | ICASSP | AudioTime: A Temporally-aligned Audio-text Benchmark Dataset. | Zeyu Xie, Xuenan Xu, Zhizheng Wu, Mengyue Wu |
| 2024 | ICASSP | Enhancing Audio Generation Diversity with Visual Information. | Zeyu Xie, Baihan Li, Xuenan Xu, Mengyue Wu, Kai Yu |
| 2024 | ICASSP | A Detailed Audio-Text Data Simulation Pipeline Using Single-Event Sounds. | Xuenan Xu, Xiaohang Xu, Zeyu Xie, Pingyue Zhang, Mengyue Wu, Kai Yu |
| 2024 | Interspeech | DiveSound: LLM-Assisted Automatic Taxonomy Construction for Diverse Audio Generation. | Baihan Li, Zeyu Xie, Xuenan Xu, Yiwei Guo, Ming Yan, Ji Zhang, Kai Yu, Mengyue Wu |
| 2024 | Interspeech | FakeSound: Deepfake General Audio Detection. | Zeyu Xie, Baihan Li, Xuenan Xu, Zheng Liang, Kai Yu, Mengyue Wu |
| 2023 | Interspeech | Enhance Temporal Relations in Audio Captioning with Sound Event Detection. | Zeyu Xie, Xuenan Xu, Mengyue Wu, Kai Yu |
| 2022 | ICASSP | Can Audio Captions Be Evaluated With Image Caption Metrics? | Zelin Zhou, Zhiling Zhang, Xuenan Xu, Zeyu Xie, Mengyue Wu, Kenny Q. Zhu |
| 2021 | ICASSP | Investigating Local and Global Information for Automated Audio Captioning with Transfer Learning. | Xuenan Xu, Heinrich Dinkel, Mengyue Wu, Zeyu Xie, Kai Yu |