| 2025 | Interspeech | Accelerating Autoregressive Speech Synthesis Inference With Speech Speculative Decoding. | Zijian Lin, Yang Zhang, Yougen Yuan, Yuming Yan, Jinjiang Liu, Zhiyong Wu, Pengfei Hu, Qun Yu |
| 2023 | Interspeech | A Method of Audio-Visual Person Verification by Mining Connections between Time Series. | Peiwen Sun, Shanshan Zhang, Zishan Liu, Yougen Yuan, Taotao Zhang, Honggang Zhang, Pengfei Hu |
| 2019 | ASRU | Verifying Deep Keyword Spotting Detection with Acoustic Word Embeddings. | Yougen Yuan, Zhiqiang Lv, Shen Huang, Lei Xie |
| 2019 | ICMI | Deep Audio-visual System for Closed-set Word-level Speech Recognition. | Yougen Yuan, Wei Tang, Minhao Fan, Yue Cao, Peng Zhang, Lei Xie |
| 2018 | Interspeech | Learning Acoustic Word Embeddings with Temporal Context for Query-by-Example Speech Search. | Yougen Yuan, Cheung-Chi Leung, Lei Xie, Hongjie Chen, Bin Ma, Haizhou Li |
| 2017 | ASRU | Extracting bottleneck features and word-like pairs from untranscribed speech for feature representation. | Yougen Yuan, Cheung-Chi Leung, Lei Xie, Hongjie Chen, Bin Ma, Haizhou Li |
| 2017 | ICASSP | Pairwise learning using multi-lingual bottleneck features for low-resource query-by-example spoken term detection. | Yougen Yuan, Cheung-Chi Leung, Lei Xie, Hongjie Chen, Bin Ma, Haizhou Li |
| 2016 | Interspeech | Learning Neural Network Representations Using Cross-Lingual Bottleneck Features with Word-Pair Information. | Yougen Yuan, Cheung-Chi Leung, Lei Xie, Bin Ma, Haizhou Li |