Skip to content

Shiyin Kang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

44

Venues

4

Active years

2009–2024

Best venue rank

A*

Where they publish

Papers

44 indexed papers, newest first.

YearVenueTitleAuthors
2024ACLChatMusician: Understanding and Generating Music Intrinsically with LLM.Ruibin Yuan, Hanfeng Lin, Yi Wang, Zeyue Tian, Shangda Wu, Tianhao Shen, Ge Zhang, Yuhang Wu, Cong Liu, Ziya Zhou, Liumeng Xue, Ziyang Ma, Qin Liu, Tianyu Zheng, Yizhi Li, Yinghao Ma, Yiming Liang, Xiaowei Chi, Ruibo Liu, Zili Wang, Chenghua Lin, Qifeng Liu, Tao Jiang, Wenhao Huang, Wenhu Chen, Jie Fu, Emmanouil Benetos, Gus Xia, Roger B. Dannenberg, Wei Xue, Shiyin Kang, Yike Guo
2024ICASSPImproving Language Model-Based Zero-Shot Text-to-Speech Synthesis with Multi-Scale Acoustic Prompts.Shun Lei, Yixuan Zhou, Liyang Chen, Dan Luo, Zhiyong Wu, Xixin Wu, Shiyin Kang, Tao Jiang, Yahui Zhou, Yuxing Han, Helen Meng
2024ICASSPMulti-View Midivae: Fusing Track- and Bar-View Representations for Long Multi-Track Symbolic Music Generation.Zhiwei Lin, Jun Chen, Boshi Tang, Binzhu Sha, Jing Yang, Yaolong Ju, Fan Fan, Shiyin Kang, Zhiyong Wu, Helen Meng
2024ICASSPGenerating Stereophonic Music with Single-Stage Language Models.Xingda Li, Fan Zhuo, Dan Luo, Jun Chen, Shiyin Kang, Zhiyong Wu, Tao Jiang, Yang Li, Han Fang, Yahui Zhou
2024ICASSPSCNet: Sparse Compression Network for Music Source Separation.Weinan Tong, Jiaxu Zhu, Jun Chen, Shiyin Kang, Tao Jiang, Yang Li, Zhiyong Wu, Helen Meng
2024InterspeechAn End-to-End Approach for Chord-Conditioned Song Generation.Shuochen Gao, Shun Lei, Fan Zhuo, Hangyu Liu, Feng Liu, Boshi Tang, Qiaochu Huang, Shiyin Kang, Zhiyong Wu
2023ICASSPContext-Aware Coherent Speaking Style Prediction with Hierarchical Transformers for Audiobook Speech Synthesis.Shun Lei, Yixuan Zhou, Liyang Chen, Zhiyong Wu, Shiyin Kang, Helen Meng
2023ICASSPTFCnet: Time-Frequency Domain Corrector for Speech Separation.Weinan Tong, Jiaxu Zhu, Jun Chen, Zhiyong Wu, Shiyin Kang, Helen Meng
2023ICASSPCB-Conformer: Contextual Biasing Conformer for Biased Word Recognition.Yaoxun Xu, Baiji Liu, Qiaochu Huang, Xingchen Song, Zhiyong Wu, Shiyin Kang, Helen Meng
2023ICASSPGTN-Bailando: Genre Consistent long-Term 3D Dance Generation Based on Pre-Trained Genre Token Network.Haolin Zhuang, Shun Lei, Long Xiao, Weiqin Li, Liyang Chen, Sicheng Yang, Zhiyong Wu, Shiyin Kang, Helen Meng
2023InterspeechTowards Spontaneous Style Modeling with Semi-supervised Pre-training for Conversational Text-to-Speech Synthesis.Weiqin Li, Shun Lei, Qiaochu Huang, Yixuan Zhou, Zhiyong Wu, Shiyin Kang, Helen Meng
2022ICASSPFullSubNet+: Channel Attention Fullsubnet with Complex Spectrograms for Speech Enhancement.Jun Chen, Zilin Wang, Deyi Tuo, Zhiyong Wu, Shiyin Kang, Helen Meng
2022ICASSPTowards Expressive Speaking Style Modelling with Hierarchical Context Information for Mandarin Speech Synthesis.Shun Lei, Yixuan Zhou, Liyang Chen, Zhiyong Wu, Shiyin Kang, Helen Meng
2022ICASSPDisentangling Content and Fine-Grained Prosody Information Via Hybrid ASR Bottleneck Features for Voice Conversion.Xintao Zhao, Feng Liu, Changhe Song, Zhiyong Wu, Shiyin Kang, Deyi Tuo, Helen Meng
2022InterspeechImproving Mandarin Prosodic Structure Prediction with Multi-level Contextual Information.Jie Chen, Changhe Song, Deyi Tuo, Xixin Wu, Shiyin Kang, Zhiyong Wu, Helen Meng
2022InterspeechTowards Multi-Scale Speaking Style Modelling with Hierarchical Context Information for Mandarin Speech Synthesis.Shun Lei, Yixuan Zhou, Liyang Chen, Jiankun Hu, Zhiyong Wu, Shiyin Kang, Helen Meng
2022InterspeechTowards Improving the Expressiveness of Singing Voice Synthesis with BERT Derived Semantic Information.Shaohuan Zhou, Shun Lei, Weiya You, Deyi Tuo, Yuren You, Zhiyong Wu, Shiyin Kang, Helen Meng
2021ICASSPThe Huya Multi-Speaker and Multi-Style Speech Synthesis System for M2voc Challenge 2020.Jie Wang, Yuren You, Feng Liu, Deyi Tuo, Shiyin Kang, Zhiyong Wu, Helen Meng
2021InterspeechVAENAR-TTS: Variational Auto-Encoder Based Non-AutoRegressive Text-to-Speech Synthesis.Hui Lu, Zhiyong Wu, Xixin Wu, Xu Li, Shiyin Kang, Xunying Liu, Helen Meng
2021InterspeechAdversarially Learning Disentangled Speech Representations for Robust Multi-Factor Voice Conversion.Jie Wang, Jingbei Li, Xintao Zhao, Zhiyong Wu, Shiyin Kang, Helen Meng
2020ICASSPCode-Switched Speech Synthesis Using Bilingual Phonetic Posteriorgram with Only Monolingual Corpora.Yuewen Cao, Songxiang Liu, Xixin Wu, Shiyin Kang, Peng Liu, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng
2020ICASSPEnd-To-End Accent Conversion Without Using Native Utterances.Songxiang Liu, Disong Wang, Yuewen Cao, Lifa Sun, Xixin Wu, Shiyin Kang, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng
2020ICASSPAudio-Visual Recognition of Overlapped Speech for the LRS2 Dataset.Jianwei Yu, Shi-Xiong Zhang, Jian Wu, Shahram Ghorbani, Bo Wu, Shiyin Kang, Shansong Liu, Xunying Liu, Helen Meng, Dong Yu
2020InterspeechTransferring Source Style in Non-Parallel Voice Conversion.Songxiang Liu, Yuewen Cao, Shiyin Kang, Na Hu, Xunying Liu, Dan Su, Dong Yu, Helen Meng
2020InterspeechDurIAN: Duration Informed Attention Network for Speech Synthesis.Chengzhu Yu, Heng Lu, Na Hu, Meng Yu, Chao Weng, Kun Xu, Peng Liu, Deyi Tuo, Shiyin Kang, Guangzhi Lei, Dan Su, Dong Yu
2019ICASSPA Compact Framework for Voice Conversion Using Wavenet Conditioned on Phonetic Posteriorgrams.Hui Lu, Zhiyong Wu, Runnan Li, Shiyin Kang, Jia Jia, Helen Meng
2019ICASSPQuasi-fully Convolutional Neural Network with Variational Inference for Speech Synthesis.Mu Wang, Xixin Wu, Zhiyong Wu, Shiyin Kang, Deyi Tuo, Guangzhi Li, Dan Su, Dong Yu, Helen Meng
2019InterspeechDisambiguation of Chinese Polyphones in an End-to-End Framework with Semantic Features Extracted by Pre-Trained BERT.Dongyang Dai, Zhiyong Wu, Shiyin Kang, Xixin Wu, Jia Jia, Dan Su, Dong Yu, Helen Meng
2019InterspeechMultimedia Simultaneous Translation System for Minority Language Communication with Mandarin.Shen Huang, Bojie Hu, Shan Huang, Pengfei Hu, Jian Kang, Zhiqiang Lv, Jinghao Yan, Qi Ju, Shiyin Kang, Deyi Tuo, Guangzhi Li, Nurmemet Yolwas
2019InterspeechOne-Shot Voice Conversion with Global Speaker Embeddings.Hui Lu, Zhiyong Wu, Dongyang Dai, Runnan Li, Shiyin Kang, Jia Jia, Helen Meng
2018ICASSPFeature Based Adaptation for Speaking Style Synthesis.Xixin Wu, Lifa Sun, Shiyin Kang, Songxiang Liu, Zhiyong Wu, Xunying Liu, Helen Meng
2018ICASSPNeural Network Language Modeling with Letter-Based Features and Importance Sampling.Hainan Xu, Ke Li, Yiming Wang, Jian Wang, Shiyin Kang, Xie Chen, Daniel Povey, Sanjeev Khudanpur
2018InterspeechRapid Style Adaptation Using Residual Error Embedding for Expressive Speech Synthesis.Xixin Wu, Yuewen Cao, Mu Wang, Songxiang Liu, Shiyin Kang, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng
2016ICASSPLearning cross-lingual information with multilingual BLSTM for speech synthesis of low-resource languages.Quanjie Yu, Peng Liu, Zhiyong Wu, Shiyin Kang, Helen Meng, Lianhong Cai
2016InterspeechPersonalized, Cross-Lingual TTS Using Phonetic Posteriorgrams.Lifa Sun, Hao Wang, Shiyin Kang, Kun Li, Helen M. Meng
2015ICASSPA deep recurrent approach for acoustic-to-articulatory inversion.Peng Liu, Quanjie Yu, Zhiyong Wu, Shiyin Kang, Helen M. Meng, Lianhong Cai
2015ICASSPVoice conversion using deep Bidirectional Long Short-Term Memory based Recurrent Neural Networks.Lifa Sun, Shiyin Kang, Kun Li, Helen M. Meng
2014InterspeechStatistical parametric speech synthesis using weighted multi-distribution deep belief network.Shiyin Kang, Helen M. Meng
2013ICASSPMulti-distribution deep belief network for speech synthesis.Shiyin Kang, Xiaojun Qian, Helen Meng
2013InterspeechLexical stress detection for L2 English speech using deep belief networks.Kun Li, Xiaojun Qian, Shiyin Kang, Helen Meng
2010ICPRComparison of Syllable/Phone HMM Based Mandarin TTS.Quansheng Duan, Shiyin Kang, Zhiyong Wu, Lianhong Cai, Zhiwei Shuang, Yong Qin
2010InterspeechHMM based TTS for mixed language text.Zhiwei Shuang, Shiyin Kang, Yong Qin, Li-Rong Dai, Lianhong Cai
2009InterspeechVoiced/unvoiced decision algorithm for HMM-based speech synthesis.Shiyin Kang, Zhiwei Shuang, Quansheng Duan, Yong Qin, Lianhong Cai
2009InterspeechSyllable HMM based Mandarin TTS and comparison with concatenative TTS.Zhiwei Shuang, Shiyin Kang, Qin Shi, Yong Qin, Lianhong Cai