Songxiang Liu
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
25
Venues
4
Active years
2018–2025
Best venue rank
A*
Where they publish
Papers
25 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ICML | ALMTokenizer: A Low-bitrate and Semantic-rich Audio Codec Tokenizer for Audio Language Modeling. | Dongchao Yang, Songxiang Liu, Haohan Guo, Jiankun Zhao, Yuanyuan Wang, Helin Wang, Zeqian Ju, Xubo Liu, Xueyuan Chen, Xu Tan, Xixin Wu, Helen M. Meng |
| 2024 | ICASSP | Unifying One-Shot Voice Conversion and Cloning with Disentangled Speech Representations. | Hui Lu, Xixin Wu, Haohan Guo, Songxiang Liu, Zhiyong Wu, Helen Meng |
| 2024 | ICML | UniAudio: Towards Universal Audio Generation with Large Language Models. | Dongchao Yang, Jinchuan Tian, Xu Tan, Rongjie Huang, Songxiang Liu, Haohan Guo, Xuankai Chang, Jiatong Shi, Sheng Zhao, Jiang Bian, Zhou Zhao, Xixin Wu, Helen M. Meng |
| 2023 | ASRU | The Singing Voice Conversion Challenge 2023. | Wen-Chin Huang, Lester Phillip Violeta, Songxiang Liu, Jiatong Shi, Tomoki Toda |
| 2023 | Interspeech | Diverse and Expressive Speech Prosody Prediction with Denoising Diffusion Probabilistic Model. | Xiang Li, Songxiang Liu, Max W. Y. Lam, Zhiyong Wu, Chao Weng, Helen Meng |
| 2023 | Interspeech | NoreSpeech: Knowledge Distillation based Conditional Diffusion Model for Noise-robust Expressive TTS. | Dongchao Yang, Songxiang Liu, Helin Wang, Jianwei Yu, Chao Weng, Yuexian Zou |
| 2022 | ICASSP | Referee: Towards Reference-Free Cross-Speaker Style Transfer with Low-Quality Data for Expressive Speech Synthesis. | Songxiang Liu, Shan Yang, Dan Su, Dong Yu |
| 2022 | ICASSP | Speaker Identity Preservation in Dysarthric Speech Reconstruction by Adversarial Speaker Adaptation. | Disong Wang, Songxiang Liu, Xixin Wu, Hui Lu, Lifa Sun, Xunying Liu, Helen Meng |
| 2022 | Interspeech | ASR-Robust Natural Language Understanding on ASR-GLUE dataset. | Lingyun Feng, Jianwei Yu, Yan Wang, Songxiang Liu, Deng Cai, Haitao Zheng |
| 2021 | ASRU | DiffSVC: A Diffusion Probabilistic Model for Singing Voice Conversion. | Songxiang Liu, Yuewen Cao, Dan Su, Helen Meng |
| 2021 | Interspeech | Learning Explicit Prosody Models and Deep Speaker Embeddings for Atypical Voice Conversion. | Disong Wang, Songxiang Liu, Lifa Sun, Xixin Wu, Xunying Liu, Helen Meng |
| 2020 | ICASSP | Multi-Layer Content Interaction Through Quaternion Product for Visual Question Answering. | Lei Shi, Shijie Geng, Kai Shuang, Chiori Hori, Songxiang Liu, Peng Gao, Sen Su |
| 2020 | ICASSP | Code-Switched Speech Synthesis Using Bilingual Phonetic Posteriorgram with Only Monolingual Corpora. | Yuewen Cao, Songxiang Liu, Xixin Wu, Shiyin Kang, Peng Liu, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2020 | ICASSP | End-To-End Accent Conversion Without Using Native Utterances. | Songxiang Liu, Disong Wang, Yuewen Cao, Lifa Sun, Xixin Wu, Shiyin Kang, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2020 | ICASSP | End-To-End Voice Conversion Via Cross-Modal Knowledge Distillation for Dysarthric Speech Reconstruction. | Disong Wang, Jianwei Yu, Xixin Wu, Songxiang Liu, Lifa Sun, Xunying Liu, Helen Meng |
| 2020 | ICASSP | Defense Against Adversarial Attacks on Spoofing Countermeasures of ASV. | Haibin Wu, Songxiang Liu, Helen Meng, Hung-yi Lee |
| 2020 | Interspeech | Transferring Source Style in Non-Parallel Voice Conversion. | Songxiang Liu, Yuewen Cao, Shiyin Kang, Na Hu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2019 | ASRU | Adversarial Attacks on Spoofing Countermeasures of Automatic Speaker Verification. | Songxiang Liu, Haibin Wu, Hung-yi Lee, Helen Meng |
| 2019 | ICASSP | End-to-end Code-switched TTS with Mix of Monolingual Recordings. | Yuewen Cao, Xixin Wu, Songxiang Liu, Jianwei Yu, Xu Li, Zhiyong Wu, Xunying Liu, Helen Meng |
| 2019 | ICASSP | Speech Emotion Recognition Using Capsule Networks. | Xixin Wu, Songxiang Liu, Yuewen Cao, Xu Li, Jianwei Yu, Dongyang Dai, Xi Ma, Shoukang Hu, Zhiyong Wu, Xunying Liu, Helen Meng |
| 2019 | ICASSP | Recurrent Neural Network Language Model Training Using Natural Gradient. | Jianwei Yu, Max W. Y. Lam, Xie Chen, Shoukang Hu, Songxiang Liu, Xixin Wu, Xunying Liu, Helen Meng |
| 2019 | Interspeech | Jointly Trained Conversion Model and WaveNet Vocoder for Non-Parallel Voice Conversion Using Mel-Spectrograms and Phonetic Posteriorgrams. | Songxiang Liu, Yuewen Cao, Xixin Wu, Lifa Sun, Xunying Liu, Helen Meng |
| 2018 | ICASSP | Feature Based Adaptation for Speaking Style Synthesis. | Xixin Wu, Lifa Sun, Shiyin Kang, Songxiang Liu, Zhiyong Wu, Xunying Liu, Helen Meng |
| 2018 | Interspeech | Voice Conversion Across Arbitrary Speakers Based on a Single Target-Speaker Utterance. | Songxiang Liu, Jinghua Zhong, Lifa Sun, Xixin Wu, Xunying Liu, Helen Meng |
| 2018 | Interspeech | Rapid Style Adaptation Using Residual Error Embedding for Expressive Speech Synthesis. | Xixin Wu, Yuewen Cao, Mu Wang, Songxiang Liu, Shiyin Kang, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |