Xinhao Mei
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
10
Venues
3
Active years
2022–2025
Best venue rank
A*
Where they publish
Papers
10 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | Interspeech | MASV: Speaker Verification with Global and Local Context Mamba. | Yang Liu, Li Wan, Yiteng Huang, Ming Sun, Xinhao Mei, Xubo Liu, Yangyang Shi, Florian Metze |
| 2024 | ICASSP | First-Shot Unsupervised Anomalous Sound Detection with Unknown Anomalies Estimated by Metadata-Assisted Audio Generation. | Hejing Zhang, Qiaoxi Zhu, Jian Guan, Haohe Liu, Feiyang Xiao, Jiantong Tian, Xinhao Mei, Xubo Liu, Wenwu Wang |
| 2023 | ICASSP | Simple Pooling Front-Ends for Efficient Audio Classification. | Xubo Liu, Haohe Liu, Qiuqiang Kong, Xinhao Mei, Mark D. Plumbley, Wenwu Wang |
| 2023 | ICML | AudioLDM: Text-to-Audio Generation with Latent Diffusion Models. | Haohe Liu, Zehua Chen, Yi Yuan, Xinhao Mei, Xubo Liu, Danilo P. Mandic, Wenwu Wang, Mark D. Plumbley |
| 2023 | Interspeech | Visually-Aware Audio Captioning With Adaptive Audio-Visual Attention. | Xubo Liu, Qiushi Huang, Xinhao Mei, Haohe Liu, Qiuqiang Kong, Jianyuan Sun, Shengchen Li, Tom Ko, Yu Zhang, H. Lilian Tang, Mark D. Plumbley, Volkan Kili, Wenwu Wang |
| 2023 | Interspeech | Ontology-aware Learning and Evaluation for Audio Tagging. | Haohe Liu, Qiuqiang Kong, Xubo Liu, Xinhao Mei, Wenwu Wang, Mark D. Plumbley |
| 2023 | Interspeech | Dual Transformer Decoder based Features Fusion Network for Automated Audio Captioning. | Jianyuan Sun, Xubo Liu, Xinhao Mei, Volkan Kili, Mark D. Plumbley, Wenwu Wang |
| 2022 | ICASSP | Diverse Audio Captioning Via Adversarial Training. | Xinhao Mei, Xubo Liu, Jianyuan Sun, Mark D. Plumbley, Wenwu Wang |
| 2022 | Interspeech | Separate What You Describe: Language-Queried Audio Source Separation. | Xubo Liu, Haohe Liu, Qiuqiang Kong, Xinhao Mei, Jinzheng Zhao, Qiushi Huang, Mark D. Plumbley, Wenwu Wang |
| 2022 | Interspeech | On Metric Learning for Audio-Text Cross-Modal Retrieval. | Xinhao Mei, Xubo Liu, Jianyuan Sun, Mark D. Plumbley, Wenwu Wang |