| 2024 | Interspeech | SA-WavLM: Speaker-Aware Self-Supervised Pre-training for Mixture Speech. | Jingru Lin, Meng Ge, Junyi Ao, Liqun Deng, Haizhou Li |
| 2023 | ICASSP | Token2vec: A Joint Self-Supervised Pre-Training Framework Using Unpaired Speech and Text. | Xianghu Yue, Junyi Ao, Xiaoxue Gao, Haizhou Li |
| 2023 | Interspeech | Self-Supervised Acoustic Word Embedding Learning via Correspondence Transformer Encoder. | Jingru Lin, Xianghu Yue, Junyi Ao, Haizhou Li |
| 2023 | Interspeech | CoBERT: Self-Supervised Speech Representation Learning Through Code Representation Learning. | Chutong Meng, Junyi Ao, Tom Ko, Mingxuan Wang, Haizhou Li |
| 2022 | ACL | SpeechT5: Unified-Modal Encoder-Decoder Pre-Training for Spoken Language Processing. | Junyi Ao, Rui Wang, Long Zhou, Chengyi Wang, Shuo Ren, Yu Wu, Shujie Liu, Tom Ko, Qing Li, Yu Zhang, Zhihua Wei, Yao Qian, Jinyu Li, Furu Wei |
| 2022 | EMNLP | SpeechUT: Bridging Speech and Text with Hidden-Unit for Encoder-Decoder Based Speech-Text Pre-training. | Ziqiang Zhang, Long Zhou, Junyi Ao, Shujie Liu, Lirong Dai, Jinyu Li, Furu Wei |
| 2022 | ICASSP | Multi-View Self-Attention Based Transformer for Speaker Recognition. | Rui Wang, Junyi Ao, Long Zhou, Shujie Liu, Zhihua Wei, Tom Ko, Qing Li, Yu Zhang |
| 2022 | Interspeech | Pre-Training Transformer Decoder for End-to-End ASR Model with Unpaired Speech Data. | Junyi Ao, Ziqiang Zhang, Long Zhou, Shujie Liu, Haizhou Li, Tom Ko, Lirong Dai, Jinyu Li, Yao Qian, Furu Wei |
| 2022 | Interspeech | LightHuBERT: Lightweight and Configurable Speech Representation Learning with Once-for-All Hidden-Unit BERT. | Rui Wang, Qibing Bai, Junyi Ao, Long Zhou, Zhixiang Xiong, Zhihua Wei, Yu Zhang, Tom Ko, Haizhou Li |