| 2025 | Interspeech | DC-Spin: A Speaker-invariant Speech Tokenizer for Spoken Language Models. | Heng-Jui Chang, Hongyu Gong, Changhan Wang, James R. Glass, Yu-An Chung |
| 2024 | ICASSP | COLLD: Contrastive Layer-to-Layer Distillation for Compressing Multilingual Pre-Trained Speech Encoders. | Heng-Jui Chang, Ning Dong, Ruslan Mavlyutov, Sravya Popuri, Yu-An Chung |
| 2023 | ACL | Speech-to-Speech Translation for a Real-world Unwritten Language. | Peng-Jen Chen, Kevin Tran, Yilin Yang, Jingfei Du, Justine Kao, Yu-An Chung, Paden Tomasello, Paul-Ambroise Duquenne, Holger Schwenk, Hongyu Gong, Hirofumi Inaguma, Sravya Popuri, Changhan Wang, Juan Pino, Wei-Ning Hsu, Ann Lee |
| 2023 | ACL | UnitY: Two-pass Direct Speech-to-speech Translation with Discrete Units. | Hirofumi Inaguma, Sravya Popuri, Ilia Kulikov, Peng-Jen Chen, Changhan Wang, Yu-An Chung, Yun Tang, Ann Lee, Shinji Watanabe, Juan Pino |
| 2022 | AAAI | SSAST: Self-Supervised Audio Spectrogram Transformer. | Yuan Gong, Cheng-I Lai, Yu-An Chung, James R. Glass |
| 2021 | ASRU | w2v-BERT: Combining Contrastive Learning and Masked Language Modeling for Self-Supervised Speech Pre-Training. | Yu-An Chung, Yu Zhang, Wei Han, Chung-Cheng Chiu, James Qin, Ruoming Pang, Yonghui Wu |
| 2021 | ICASSP | Similarity Analysis of Self-Supervised Speech Representations. | Yu-An Chung, Yonatan Belinkov, James R. Glass |
| 2021 | Interspeech | AST: Audio Spectrogram Transformer. | Yuan Gong, Yu-An Chung, James R. Glass |
| 2021 | Interspeech | Non-Autoregressive Predictive Coding for Learning Speech Representations from Local Dependencies. | Alexander H. Liu, Yu-An Chung, James R. Glass |
| 2021 | NAACL | SPLAT: Speech-Language Joint Pre-Training for Spoken Language Understanding. | Yu-An Chung, Chenguang Zhu, Michael Zeng |
| 2020 | ACL | Improved Speech Representations with Multi-Target Autoregressive Predictive Coding. | Yu-An Chung, James R. Glass |
| 2020 | ICASSP | Generative Pre-Training for Speech with Autoregressive Predictive Coding. | Yu-An Chung, James R. Glass |
| 2020 | Interspeech | Vector-Quantized Autoregressive Predictive Coding. | Yu-An Chung, Hao Tang, James R. Glass |
| 2019 | ICASSP | Semi-supervised Training for Improving Data Efficiency in End-to-end Speech Synthesis. | Yu-An Chung, Yuxuan Wang, Wei-Ning Hsu, Yu Zhang, R. J. Skerry-Ryan |
| 2019 | ICASSP | Towards Unsupervised Speech-to-text Translation. | Yu-An Chung, Wei-Hung Weng, Schrasing Tong, James R. Glass |
| 2019 | ICASSP | Disentangling Correlated Speaker and Noise for Speech Synthesis via Data Augmentation and Adversarial Factorization. | Wei-Ning Hsu, Yu Zhang, Ron J. Weiss, Yu-An Chung, Yuxuan Wang, Yonghui Wu, James R. Glass |
| 2019 | Interspeech | An Unsupervised Autoregressive Model for Speech Representation Learning. | Yu-An Chung, Wei-Ning Hsu, Hao Tang, James R. Glass |
| 2019 | KDD | Unsupervised Clinical Language Translation. | Wei-Hung Weng, Yu-An Chung, Peter Szolovits |
| 2018 | Interspeech | Speech2Vec: A Sequence-to-Sequence Framework for Learning Word Embeddings from Speech. | Yu-An Chung, James R. Glass |
| 2018 | NAACL | Supervised and Unsupervised Transfer Learning for Question Answering. | Yu-An Chung, Hung-yi Lee, James R. Glass |
| 2016 | IJCAI | Cost-Aware Pre-Training for Multiclass Cost-Sensitive Deep Learning. | Yu-An Chung, Hsuan-Tien Lin, Shao-Wen Yang |
| 2016 | Interspeech | Audio Word2Vec: Unsupervised Learning of Audio Segment Representations Using Sequence-to-Sequence Autoencoder. | Yu-An Chung, Chao-Chung Wu, Chia-Hao Shen, Hung-yi Lee, Lin-Shan Lee |