Shansong Liu
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
24
Venues
2
Active years
2018–2025
Best venue rank
A
Where they publish
Papers
24 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ICASSP | Editing Music with Melody and Text: Using ControlNet for Diffusion Transformer. | Siyuan Hou, Shansong Liu, Ruibin Yuan, Wei Xue, Ying Shan, Mangsuo Zhao, Chao Zhang |
| 2024 | ICASSP | Music Understanding LLaMA: Advancing Text-to-Music Generation with Question Answering and Captioning. | Shansong Liu, Atin Sakkeer Hussain, Chenshuo Sun, Ying Shan |
| 2024 | ICASSP | Humtrans: A Novel Open-Source Dataset for Humming Melody Transcription and Beyond. | Shansong Liu, Xu Li, Dian Li, Ying Shan |
| 2024 | ICASSP | Unified Pretraining Target Based Video-Music Retrieval with Music Rhythm and Video Optical Flow Information. | Tianjun Mao, Shansong Liu, Yunxuan Zhang, Dian Li, Ying Shan |
| 2023 | Interspeech | Prosody Modeling with 3D Visual Information for Expressive Video Dubbing. | Zhihan Yang, Shansong Liu, Xu Li, Haozhe Wu, Zhiyong Wu, Ying Shan, Jia Jia |
| 2022 | ICASSP | Exploiting Cross Domain Acoustic-to-Articulatory Inverted Features for Disordered Speech Recognition. | Shujie Hu, Shansong Liu, Xurong Xie, Mengzhe Geng, Tianzi Wang, Shoukang Hu, Mingyu Cui, Xunying Liu, Helen Meng |
| 2022 | Interspeech | A Hierarchical Speaker Representation Framework for One-shot Singing Voice Conversion. | Xu Li, Shansong Liu, Ying Shan |
| 2021 | ICASSP | Neural Architecture Search for LF-MMI Trained Time Delay Neural Networks. | Shoukang Hu, Xurong Xie, Shansong Liu, Mingyu Cui, Mengzhe Geng, Xunying Liu, Helen Meng |
| 2021 | ICASSP | Bayesian Transformer Language Models for Speech Recognition. | Boyang Xue, Jianwei Yu, Junhao Xu, Shansong Liu, Shoukang Hu, Zi Ye, Mengzhe Geng, Xunying Liu, Helen Meng |
| 2021 | ICASSP | Development of the Cuhk Elderly Speech Recognition System for Neurocognitive Disorder Detection Using the Dementiabank Corpus. | Zi Ye, Shoukang Hu, Jinchao Li, Xurong Xie, Mengzhe Geng, Jianwei Yu, Junhao Xu, Boyang Xue, Shansong Liu, Xunying Liu, Helen Meng |
| 2021 | Interspeech | Bayesian Parametric and Architectural Domain Adaptation of LF-MMI Trained TDNNs for Elderly and Dysarthric Speech Recognition. | Jiajun Deng, Fabian Ritter Gutierrez, Shoukang Hu, Mengzhe Geng, Xurong Xie, Zi Ye, Shansong Liu, Jianwei Yu, Xunying Liu, Helen Meng |
| 2021 | Interspeech | Spectro-Temporal Deep Features for Disordered Speech Assessment and Recognition. | Mengzhe Geng, Shansong Liu, Jianwei Yu, Xurong Xie, Shoukang Hu, Zi Ye, Zengrui Jin, Xunying Liu, Helen Meng |
| 2021 | Interspeech | Adversarial Data Augmentation for Disordered Speech Recognition. | Zengrui Jin, Mengzhe Geng, Xurong Xie, Jianwei Yu, Shansong Liu, Xunying Liu, Helen Meng |
| 2020 | ICASSP | Audio-Visual Recognition of Overlapped Speech for the LRS2 Dataset. | Jianwei Yu, Shi-Xiong Zhang, Jian Wu, Shahram Ghorbani, Bo Wu, Shiyin Kang, Shansong Liu, Xunying Liu, Helen Meng, Dong Yu |
| 2020 | Interspeech | Investigation of Data Augmentation Techniques for Disordered Speech Recognition. | Mengzhe Geng, Xurong Xie, Shansong Liu, Jianwei Yu, Shoukang Hu, Xunying Liu, Helen Meng |
| 2020 | Interspeech | Exploiting Cross-Domain Visual Feature Generation for Disordered Speech Recognition. | Shansong Liu, Xurong Xie, Jianwei Yu, Shoukang Hu, Mengzhe Geng, Rongfeng Su, Shi-Xiong Zhang, Xunying Liu, Helen Meng |
| 2019 | ICASSP | Bayesian and Gaussian Process Neural Networks for Large Vocabulary Continuous Speech Recognition. | Shoukang Hu, Max W. Y. Lam, Xurong Xie, Shansong Liu, Jianwei Yu, Xixin Wu, Xunying Liu, Helen Meng |
| 2019 | Interspeech | The CUHK Dysarthric Speech Recognition Systems for English and Cantonese. | Shoukang Hu, Shansong Liu, Heng Fai Chang, Mengzhe Geng, Jiani Chen, Lau Wing Chung, To Ka Hei, Jianwei Yu, Ka Ho Wong, Xunying Liu, Helen Meng |
| 2019 | Interspeech | LF-MMI Training of Bayesian and Gaussian Process Time Delay Neural Networks for Speech Recognition. | Shoukang Hu, Xurong Xie, Shansong Liu, Max W. Y. Lam, Jianwei Yu, Xixin Wu, Xunying Liu, Helen Meng |
| 2019 | Interspeech | On the Use of Pitch Features for Disordered Speech Recognition. | Shansong Liu, Shoukang Hu, Xunying Liu, Helen Meng |
| 2019 | Interspeech | Exploiting Visual Features Using Bayesian Gated Neural Networks for Disordered Speech Recognition. | Shansong Liu, Shoukang Hu, Yi Wang, Jianwei Yu, Rongfeng Su, Xunying Liu, Helen Meng |
| 2018 | ICASSP | Limited-Memory BFGS Optimization of Recurrent Neural Network Language Models for Speech Recognition. | Xunying Liu, Shansong Liu, Jinze Sha, Jianwei Yu, Zhiyuan Xu, Xie Chen, Helen Meng |
| 2018 | Interspeech | Gaussian Process Neural Networks for Speech Recognition. | Max W. Y. Lam, Shoukang Hu, Xurong Xie, Shansong Liu, Jianwei Yu, Rongfeng Su, Xunying Liu, Helen Meng |
| 2018 | Interspeech | Development of the CUHK Dysarthric Speech Recognition System for the UA Speech Corpus. | Jianwei Yu, Xurong Xie, Shansong Liu, Shoukang Hu, Max W. Y. Lam, Xixin Wu, Ka Ho Wong, Xunying Liu, Helen Meng |