Skip to content

Shansong Liu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

24

Venues

2

Active years

2018–2025

Best venue rank

A

Where they publish

Papers

24 indexed papers, newest first.

YearVenueTitleAuthors
2025ICASSPEditing Music with Melody and Text: Using ControlNet for Diffusion Transformer.Siyuan Hou, Shansong Liu, Ruibin Yuan, Wei Xue, Ying Shan, Mangsuo Zhao, Chao Zhang
2024ICASSPMusic Understanding LLaMA: Advancing Text-to-Music Generation with Question Answering and Captioning.Shansong Liu, Atin Sakkeer Hussain, Chenshuo Sun, Ying Shan
2024ICASSPHumtrans: A Novel Open-Source Dataset for Humming Melody Transcription and Beyond.Shansong Liu, Xu Li, Dian Li, Ying Shan
2024ICASSPUnified Pretraining Target Based Video-Music Retrieval with Music Rhythm and Video Optical Flow Information.Tianjun Mao, Shansong Liu, Yunxuan Zhang, Dian Li, Ying Shan
2023InterspeechProsody Modeling with 3D Visual Information for Expressive Video Dubbing.Zhihan Yang, Shansong Liu, Xu Li, Haozhe Wu, Zhiyong Wu, Ying Shan, Jia Jia
2022ICASSPExploiting Cross Domain Acoustic-to-Articulatory Inverted Features for Disordered Speech Recognition.Shujie Hu, Shansong Liu, Xurong Xie, Mengzhe Geng, Tianzi Wang, Shoukang Hu, Mingyu Cui, Xunying Liu, Helen Meng
2022InterspeechA Hierarchical Speaker Representation Framework for One-shot Singing Voice Conversion.Xu Li, Shansong Liu, Ying Shan
2021ICASSPNeural Architecture Search for LF-MMI Trained Time Delay Neural Networks.Shoukang Hu, Xurong Xie, Shansong Liu, Mingyu Cui, Mengzhe Geng, Xunying Liu, Helen Meng
2021ICASSPBayesian Transformer Language Models for Speech Recognition.Boyang Xue, Jianwei Yu, Junhao Xu, Shansong Liu, Shoukang Hu, Zi Ye, Mengzhe Geng, Xunying Liu, Helen Meng
2021ICASSPDevelopment of the Cuhk Elderly Speech Recognition System for Neurocognitive Disorder Detection Using the Dementiabank Corpus.Zi Ye, Shoukang Hu, Jinchao Li, Xurong Xie, Mengzhe Geng, Jianwei Yu, Junhao Xu, Boyang Xue, Shansong Liu, Xunying Liu, Helen Meng
2021InterspeechBayesian Parametric and Architectural Domain Adaptation of LF-MMI Trained TDNNs for Elderly and Dysarthric Speech Recognition.Jiajun Deng, Fabian Ritter Gutierrez, Shoukang Hu, Mengzhe Geng, Xurong Xie, Zi Ye, Shansong Liu, Jianwei Yu, Xunying Liu, Helen Meng
2021InterspeechSpectro-Temporal Deep Features for Disordered Speech Assessment and Recognition.Mengzhe Geng, Shansong Liu, Jianwei Yu, Xurong Xie, Shoukang Hu, Zi Ye, Zengrui Jin, Xunying Liu, Helen Meng
2021InterspeechAdversarial Data Augmentation for Disordered Speech Recognition.Zengrui Jin, Mengzhe Geng, Xurong Xie, Jianwei Yu, Shansong Liu, Xunying Liu, Helen Meng
2020ICASSPAudio-Visual Recognition of Overlapped Speech for the LRS2 Dataset.Jianwei Yu, Shi-Xiong Zhang, Jian Wu, Shahram Ghorbani, Bo Wu, Shiyin Kang, Shansong Liu, Xunying Liu, Helen Meng, Dong Yu
2020InterspeechInvestigation of Data Augmentation Techniques for Disordered Speech Recognition.Mengzhe Geng, Xurong Xie, Shansong Liu, Jianwei Yu, Shoukang Hu, Xunying Liu, Helen Meng
2020InterspeechExploiting Cross-Domain Visual Feature Generation for Disordered Speech Recognition.Shansong Liu, Xurong Xie, Jianwei Yu, Shoukang Hu, Mengzhe Geng, Rongfeng Su, Shi-Xiong Zhang, Xunying Liu, Helen Meng
2019ICASSPBayesian and Gaussian Process Neural Networks for Large Vocabulary Continuous Speech Recognition.Shoukang Hu, Max W. Y. Lam, Xurong Xie, Shansong Liu, Jianwei Yu, Xixin Wu, Xunying Liu, Helen Meng
2019InterspeechThe CUHK Dysarthric Speech Recognition Systems for English and Cantonese.Shoukang Hu, Shansong Liu, Heng Fai Chang, Mengzhe Geng, Jiani Chen, Lau Wing Chung, To Ka Hei, Jianwei Yu, Ka Ho Wong, Xunying Liu, Helen Meng
2019InterspeechLF-MMI Training of Bayesian and Gaussian Process Time Delay Neural Networks for Speech Recognition.Shoukang Hu, Xurong Xie, Shansong Liu, Max W. Y. Lam, Jianwei Yu, Xixin Wu, Xunying Liu, Helen Meng
2019InterspeechOn the Use of Pitch Features for Disordered Speech Recognition.Shansong Liu, Shoukang Hu, Xunying Liu, Helen Meng
2019InterspeechExploiting Visual Features Using Bayesian Gated Neural Networks for Disordered Speech Recognition.Shansong Liu, Shoukang Hu, Yi Wang, Jianwei Yu, Rongfeng Su, Xunying Liu, Helen Meng
2018ICASSPLimited-Memory BFGS Optimization of Recurrent Neural Network Language Models for Speech Recognition.Xunying Liu, Shansong Liu, Jinze Sha, Jianwei Yu, Zhiyuan Xu, Xie Chen, Helen Meng
2018InterspeechGaussian Process Neural Networks for Speech Recognition.Max W. Y. Lam, Shoukang Hu, Xurong Xie, Shansong Liu, Jianwei Yu, Rongfeng Su, Xunying Liu, Helen Meng
2018InterspeechDevelopment of the CUHK Dysarthric Speech Recognition System for the UA Speech Corpus.Jianwei Yu, Xurong Xie, Shansong Liu, Shoukang Hu, Max W. Y. Lam, Xixin Wu, Ka Ho Wong, Xunying Liu, Helen Meng