Skip to content

Xubo Liu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

33

Venues

9

Active years

2021–2025

Best venue rank

A*

Where they publish

Papers

33 indexed papers, newest first.

YearVenueTitleAuthors
2025EMNLPRiTTA: Modeling Event Relations in Text-to-Audio Generation.Yuhang He, Yash Jain, Xubo Liu, Andrew Markham, Vibhav Vineet
2025ICASSPLearning Source Disentanglement in Neural Audio Codec.Xiaoyu Bie, Xubo Liu, Gal Richard
2025ICASSPNCL-CIR: Noise-aware Contrastive Learning for Composed Image Retrieval.Peng Gao, Yujian Lee, Zailong Chen, Xubo Liu, Hui Zhang, Yiyang Hu, Guquan Jing
2025ICASSPDisentangling Hierarchical Features for Anomalous Sound Detection Under Domain Shift.Jian Guan, Jiantong Tian, Qiaoxi Zhu, Feiyang Xiao, Hejing Zhang, Xubo Liu
2025ICASSPFlowSep: Language-Queried Sound Separation with Rectified Flow Matching.Yi Yuan, Xubo Liu, Haohe Liu, Mark D. Plumbley, Wenwu Wang
2025ICASSPSound-VECaps: Improving Audio Generation with Visually Enhanced Captions.Yi Yuan, Dongya Jia, Xiaobin Zhuang, Yuanzhe Chen, Zhuo Chen, Yuping Wang, Yuxuan Wang, Xubo Liu, Xiyuan Kang, Mark D. Plumbley, Wenwu Wang
2025ICLRScaling Transformers for Low-Bitrate High-Quality Speech Coding.Julian D. Parker, Anton Smirnov, Jordi Pons, CJ Carr, Zack Zukowski, Zach Evans, Xubo Liu
2025ICMLALMTokenizer: A Low-bitrate and Semantic-rich Audio Codec Tokenizer for Audio Language Modeling.Dongchao Yang, Songxiang Liu, Haohan Guo, Jiankun Zhao, Yuanyuan Wang, Helin Wang, Zeqian Ju, Xubo Liu, Xueyuan Chen, Xu Tan, Xixin Wu, Helen M. Meng
2025InterspeechMASV: Speaker Verification with Global and Local Context Mamba.Yang Liu, Li Wan, Yiteng Huang, Ming Sun, Xinhao Mei, Xubo Liu, Yangyang Shi, Florian Metze
2024AAAILearning Temporal Resolution in Spectrogram for Audio Classification.Haohe Liu, Xubo Liu, Qiuqiang Kong, Wenwu Wang, Mark D. Plumbley
2024ACLSelective Prompting Tuning for Personalized Conversations with LLMs.Qiushi Huang, Xubo Liu, Tom Ko, Bo Wu, Wenwu Wang, Yu Zhang, Lilian Tang
2024COLINGLook before You Leap: Dual Logical Verification for Knowledge-based Visual Question Generation.Xumeng Liu, Wenya Guo, Ying Zhang, Xubo Liu, Yu Zhao, Shenglong Yu, Xiaojie Yuan
2024ICASSPCM-PIE: Cross-Modal Perception for Interactive-Enhanced Audio-Visual Video Parsing.Yaru Chen, Ruohao Guo, Xubo Liu, Peipei Wu, Guangyao Li, Zhenbo Li, Wenwu Wang
2024ICASSPAudio Prompt Tuning for Universal Sound Separation.Yuzhuo Liu, Xubo Liu, Yan Zhao, Yuanyuan Wang, Rui Xia, Pingchuan Tain, Yuxuan Wang
2024ICASSPRetrieval-Augmented Text-to-Audio Generation.Yi Yuan, Haohe Liu, Xubo Liu, Qiushi Huang, Mark D. Plumbley, Wenwu Wang
2024ICASSPFirst-Shot Unsupervised Anomalous Sound Detection with Unknown Anomalies Estimated by Metadata-Assisted Audio Generation.Hejing Zhang, Qiaoxi Zhu, Jian Guan, Haohe Liu, Feiyang Xiao, Jiantong Tian, Xinhao Mei, Xubo Liu, Wenwu Wang
2023AAAIPersonalized Dialogue Generation with Persona-Adaptive Attention.Qiushi Huang, Yu Zhang, Tom Ko, Xubo Liu, Bo Wu, Wenwu Wang, H. Lilian Tang
2023CVPRSynthVSR: Scaling Up Visual Speech RecognitionWith Synthetic Supervision.Xubo Liu, Egor Lakomkin, Konstantinos Vougioukas, Pingchuan Ma, Honglie Chen, Ruiming Xie, Morrie Doulaty, Niko Moritz, Jchym Kolr, Stavros Petridis, Maja Pantic, Christian Fuegen
2023EMNLPLearning Retrieval Augmentation for Personalized Dialogue Generation.Qiushi Huang, Shuai Fu, Xubo Liu, Wenwu Wang, Tom Ko, Yu Zhang, Lilian Tang
2023ICASSPSimple Pooling Front-Ends for Efficient Audio Classification.Xubo Liu, Haohe Liu, Qiuqiang Kong, Xinhao Mei, Mark D. Plumbley, Wenwu Wang
2023ICMLAudioLDM: Text-to-Audio Generation with Latent Diffusion Models.Haohe Liu, Zehua Chen, Yi Yuan, Xinhao Mei, Xubo Liu, Danilo P. Mandic, Wenwu Wang, Mark D. Plumbley
2023InterspeechAdapting Language-Audio Models as Few-Shot Audio Learners.Jinhua Liang, Xubo Liu, Haohe Liu, Huy Phan, Emmanouil Benetos, Mark D. Plumbley, Wenwu Wang
2023InterspeechVisually-Aware Audio Captioning With Adaptive Audio-Visual Attention.Xubo Liu, Qiushi Huang, Xinhao Mei, Haohe Liu, Qiuqiang Kong, Jianyuan Sun, Shengchen Li, Tom Ko, Yu Zhang, H. Lilian Tang, Mark D. Plumbley, Volkan Kili, Wenwu Wang
2023InterspeechOntology-aware Learning and Evaluation for Audio Tagging.Haohe Liu, Qiuqiang Kong, Xubo Liu, Xinhao Mei, Wenwu Wang, Mark D. Plumbley
2023InterspeechDual Transformer Decoder based Features Fusion Network for Automated Audio Captioning.Jianyuan Sun, Xubo Liu, Xinhao Mei, Volkan Kili, Mark D. Plumbley, Wenwu Wang
2022ICASSPDiverse Audio Captioning Via Adversarial Training.Xinhao Mei, Xubo Liu, Jianyuan Sun, Mark D. Plumbley, Wenwu Wang
2022ICASSPAudio-Visual Tracking of Multiple Speakers Via a PMBM Filter.Jinzheng Zhao, Peipei Wu, Xubo Liu, Yong Xu, Lyudmila Mihaylova, Simon J. Godsill, Wenwu Wang
2022InterspeechNeural Vocoder is All You Need for Speech Super-resolution.Haohe Liu, Woosung Choi, Xubo Liu, Qiuqiang Kong, Qiao Tian, DeLiang Wang
2022InterspeechSeparate What You Describe: Language-Queried Audio Source Separation.Xubo Liu, Haohe Liu, Qiuqiang Kong, Xinhao Mei, Jinzheng Zhao, Qiushi Huang, Mark D. Plumbley, Wenwu Wang
2022InterspeechVoiceFixer: A Unified Framework for High-Fidelity Speech Restoration.Haohe Liu, Xubo Liu, Qiuqiang Kong, Qiao Tian, Yan Zhao, DeLiang Wang, Chuanzeng Huang, Yuxuan Wang
2022InterspeechOn Metric Learning for Audio-Text Cross-Modal Retrieval.Xinhao Mei, Xubo Liu, Jianyuan Sun, Mark D. Plumbley, Wenwu Wang
2022InterspeechAudio Visual Multi-Speaker Tracking with Improved GCF and PMBM Filter.Jinzheng Zhao, Peipei Wu, Xubo Liu, Shidrokh Goudarzi, Haohe Liu, Yong Xu, Wenwu Wang
2021InterspeechToken-Level Supervised Contrastive Learning for Punctuation Restoration.Qiushi Huang, Tom Ko, H. Lilian Tang, Xubo Liu, Bo Wu