Shiyin Kang
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
44
Venues
4
Active years
2009–2024
Best venue rank
A*
Where they publish
Papers
44 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2024 | ACL | ChatMusician: Understanding and Generating Music Intrinsically with LLM. | Ruibin Yuan, Hanfeng Lin, Yi Wang, Zeyue Tian, Shangda Wu, Tianhao Shen, Ge Zhang, Yuhang Wu, Cong Liu, Ziya Zhou, Liumeng Xue, Ziyang Ma, Qin Liu, Tianyu Zheng, Yizhi Li, Yinghao Ma, Yiming Liang, Xiaowei Chi, Ruibo Liu, Zili Wang, Chenghua Lin, Qifeng Liu, Tao Jiang, Wenhao Huang, Wenhu Chen, Jie Fu, Emmanouil Benetos, Gus Xia, Roger B. Dannenberg, Wei Xue, Shiyin Kang, Yike Guo |
| 2024 | ICASSP | Improving Language Model-Based Zero-Shot Text-to-Speech Synthesis with Multi-Scale Acoustic Prompts. | Shun Lei, Yixuan Zhou, Liyang Chen, Dan Luo, Zhiyong Wu, Xixin Wu, Shiyin Kang, Tao Jiang, Yahui Zhou, Yuxing Han, Helen Meng |
| 2024 | ICASSP | Multi-View Midivae: Fusing Track- and Bar-View Representations for Long Multi-Track Symbolic Music Generation. | Zhiwei Lin, Jun Chen, Boshi Tang, Binzhu Sha, Jing Yang, Yaolong Ju, Fan Fan, Shiyin Kang, Zhiyong Wu, Helen Meng |
| 2024 | ICASSP | Generating Stereophonic Music with Single-Stage Language Models. | Xingda Li, Fan Zhuo, Dan Luo, Jun Chen, Shiyin Kang, Zhiyong Wu, Tao Jiang, Yang Li, Han Fang, Yahui Zhou |
| 2024 | ICASSP | SCNet: Sparse Compression Network for Music Source Separation. | Weinan Tong, Jiaxu Zhu, Jun Chen, Shiyin Kang, Tao Jiang, Yang Li, Zhiyong Wu, Helen Meng |
| 2024 | Interspeech | An End-to-End Approach for Chord-Conditioned Song Generation. | Shuochen Gao, Shun Lei, Fan Zhuo, Hangyu Liu, Feng Liu, Boshi Tang, Qiaochu Huang, Shiyin Kang, Zhiyong Wu |
| 2023 | ICASSP | Context-Aware Coherent Speaking Style Prediction with Hierarchical Transformers for Audiobook Speech Synthesis. | Shun Lei, Yixuan Zhou, Liyang Chen, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2023 | ICASSP | TFCnet: Time-Frequency Domain Corrector for Speech Separation. | Weinan Tong, Jiaxu Zhu, Jun Chen, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2023 | ICASSP | CB-Conformer: Contextual Biasing Conformer for Biased Word Recognition. | Yaoxun Xu, Baiji Liu, Qiaochu Huang, Xingchen Song, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2023 | ICASSP | GTN-Bailando: Genre Consistent long-Term 3D Dance Generation Based on Pre-Trained Genre Token Network. | Haolin Zhuang, Shun Lei, Long Xiao, Weiqin Li, Liyang Chen, Sicheng Yang, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2023 | Interspeech | Towards Spontaneous Style Modeling with Semi-supervised Pre-training for Conversational Text-to-Speech Synthesis. | Weiqin Li, Shun Lei, Qiaochu Huang, Yixuan Zhou, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2022 | ICASSP | FullSubNet+: Channel Attention Fullsubnet with Complex Spectrograms for Speech Enhancement. | Jun Chen, Zilin Wang, Deyi Tuo, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2022 | ICASSP | Towards Expressive Speaking Style Modelling with Hierarchical Context Information for Mandarin Speech Synthesis. | Shun Lei, Yixuan Zhou, Liyang Chen, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2022 | ICASSP | Disentangling Content and Fine-Grained Prosody Information Via Hybrid ASR Bottleneck Features for Voice Conversion. | Xintao Zhao, Feng Liu, Changhe Song, Zhiyong Wu, Shiyin Kang, Deyi Tuo, Helen Meng |
| 2022 | Interspeech | Improving Mandarin Prosodic Structure Prediction with Multi-level Contextual Information. | Jie Chen, Changhe Song, Deyi Tuo, Xixin Wu, Shiyin Kang, Zhiyong Wu, Helen Meng |
| 2022 | Interspeech | Towards Multi-Scale Speaking Style Modelling with Hierarchical Context Information for Mandarin Speech Synthesis. | Shun Lei, Yixuan Zhou, Liyang Chen, Jiankun Hu, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2022 | Interspeech | Towards Improving the Expressiveness of Singing Voice Synthesis with BERT Derived Semantic Information. | Shaohuan Zhou, Shun Lei, Weiya You, Deyi Tuo, Yuren You, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2021 | ICASSP | The Huya Multi-Speaker and Multi-Style Speech Synthesis System for M2voc Challenge 2020. | Jie Wang, Yuren You, Feng Liu, Deyi Tuo, Shiyin Kang, Zhiyong Wu, Helen Meng |
| 2021 | Interspeech | VAENAR-TTS: Variational Auto-Encoder Based Non-AutoRegressive Text-to-Speech Synthesis. | Hui Lu, Zhiyong Wu, Xixin Wu, Xu Li, Shiyin Kang, Xunying Liu, Helen Meng |
| 2021 | Interspeech | Adversarially Learning Disentangled Speech Representations for Robust Multi-Factor Voice Conversion. | Jie Wang, Jingbei Li, Xintao Zhao, Zhiyong Wu, Shiyin Kang, Helen Meng |
| 2020 | ICASSP | Code-Switched Speech Synthesis Using Bilingual Phonetic Posteriorgram with Only Monolingual Corpora. | Yuewen Cao, Songxiang Liu, Xixin Wu, Shiyin Kang, Peng Liu, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2020 | ICASSP | End-To-End Accent Conversion Without Using Native Utterances. | Songxiang Liu, Disong Wang, Yuewen Cao, Lifa Sun, Xixin Wu, Shiyin Kang, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2020 | ICASSP | Audio-Visual Recognition of Overlapped Speech for the LRS2 Dataset. | Jianwei Yu, Shi-Xiong Zhang, Jian Wu, Shahram Ghorbani, Bo Wu, Shiyin Kang, Shansong Liu, Xunying Liu, Helen Meng, Dong Yu |
| 2020 | Interspeech | Transferring Source Style in Non-Parallel Voice Conversion. | Songxiang Liu, Yuewen Cao, Shiyin Kang, Na Hu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2020 | Interspeech | DurIAN: Duration Informed Attention Network for Speech Synthesis. | Chengzhu Yu, Heng Lu, Na Hu, Meng Yu, Chao Weng, Kun Xu, Peng Liu, Deyi Tuo, Shiyin Kang, Guangzhi Lei, Dan Su, Dong Yu |
| 2019 | ICASSP | A Compact Framework for Voice Conversion Using Wavenet Conditioned on Phonetic Posteriorgrams. | Hui Lu, Zhiyong Wu, Runnan Li, Shiyin Kang, Jia Jia, Helen Meng |
| 2019 | ICASSP | Quasi-fully Convolutional Neural Network with Variational Inference for Speech Synthesis. | Mu Wang, Xixin Wu, Zhiyong Wu, Shiyin Kang, Deyi Tuo, Guangzhi Li, Dan Su, Dong Yu, Helen Meng |
| 2019 | Interspeech | Disambiguation of Chinese Polyphones in an End-to-End Framework with Semantic Features Extracted by Pre-Trained BERT. | Dongyang Dai, Zhiyong Wu, Shiyin Kang, Xixin Wu, Jia Jia, Dan Su, Dong Yu, Helen Meng |
| 2019 | Interspeech | Multimedia Simultaneous Translation System for Minority Language Communication with Mandarin. | Shen Huang, Bojie Hu, Shan Huang, Pengfei Hu, Jian Kang, Zhiqiang Lv, Jinghao Yan, Qi Ju, Shiyin Kang, Deyi Tuo, Guangzhi Li, Nurmemet Yolwas |
| 2019 | Interspeech | One-Shot Voice Conversion with Global Speaker Embeddings. | Hui Lu, Zhiyong Wu, Dongyang Dai, Runnan Li, Shiyin Kang, Jia Jia, Helen Meng |
| 2018 | ICASSP | Feature Based Adaptation for Speaking Style Synthesis. | Xixin Wu, Lifa Sun, Shiyin Kang, Songxiang Liu, Zhiyong Wu, Xunying Liu, Helen Meng |
| 2018 | ICASSP | Neural Network Language Modeling with Letter-Based Features and Importance Sampling. | Hainan Xu, Ke Li, Yiming Wang, Jian Wang, Shiyin Kang, Xie Chen, Daniel Povey, Sanjeev Khudanpur |
| 2018 | Interspeech | Rapid Style Adaptation Using Residual Error Embedding for Expressive Speech Synthesis. | Xixin Wu, Yuewen Cao, Mu Wang, Songxiang Liu, Shiyin Kang, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2016 | ICASSP | Learning cross-lingual information with multilingual BLSTM for speech synthesis of low-resource languages. | Quanjie Yu, Peng Liu, Zhiyong Wu, Shiyin Kang, Helen Meng, Lianhong Cai |
| 2016 | Interspeech | Personalized, Cross-Lingual TTS Using Phonetic Posteriorgrams. | Lifa Sun, Hao Wang, Shiyin Kang, Kun Li, Helen M. Meng |
| 2015 | ICASSP | A deep recurrent approach for acoustic-to-articulatory inversion. | Peng Liu, Quanjie Yu, Zhiyong Wu, Shiyin Kang, Helen M. Meng, Lianhong Cai |
| 2015 | ICASSP | Voice conversion using deep Bidirectional Long Short-Term Memory based Recurrent Neural Networks. | Lifa Sun, Shiyin Kang, Kun Li, Helen M. Meng |
| 2014 | Interspeech | Statistical parametric speech synthesis using weighted multi-distribution deep belief network. | Shiyin Kang, Helen M. Meng |
| 2013 | ICASSP | Multi-distribution deep belief network for speech synthesis. | Shiyin Kang, Xiaojun Qian, Helen Meng |
| 2013 | Interspeech | Lexical stress detection for L2 English speech using deep belief networks. | Kun Li, Xiaojun Qian, Shiyin Kang, Helen Meng |
| 2010 | ICPR | Comparison of Syllable/Phone HMM Based Mandarin TTS. | Quansheng Duan, Shiyin Kang, Zhiyong Wu, Lianhong Cai, Zhiwei Shuang, Yong Qin |
| 2010 | Interspeech | HMM based TTS for mixed language text. | Zhiwei Shuang, Shiyin Kang, Yong Qin, Li-Rong Dai, Lianhong Cai |
| 2009 | Interspeech | Voiced/unvoiced decision algorithm for HMM-based speech synthesis. | Shiyin Kang, Zhiwei Shuang, Quansheng Duan, Yong Qin, Lianhong Cai |
| 2009 | Interspeech | Syllable HMM based Mandarin TTS and comparison with concatenative TTS. | Zhiwei Shuang, Shiyin Kang, Qin Shi, Yong Qin, Lianhong Cai |