Changhan Wang
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
37
Venues
12
Active years
2018–2025
Best venue rank
A*
Where they publish
Papers
37 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | Interspeech | DC-Spin: A Speaker-invariant Speech Tokenizer for Spoken Language Models. | Heng-Jui Chang, Hongyu Gong, Changhan Wang, James R. Glass, Yu-An Chung |
| 2024 | ACL | XLAVS-R: Cross-Lingual Audio-Visual Speech Representation Learning for Noise-Robust Speech Perception. | HyoJung Han, Mohamed Anwar, Juan Pino, Wei-Ning Hsu, Marine Carpuat, Bowen Shi, Changhan Wang |
| 2023 | ACL | Speech-to-Speech Translation for a Real-world Unwritten Language. | Peng-Jen Chen, Kevin Tran, Yilin Yang, Jingfei Du, Justine Kao, Yu-An Chung, Paden Tomasello, Paul-Ambroise Duquenne, Holger Schwenk, Hongyu Gong, Hirofumi Inaguma, Sravya Popuri, Changhan Wang, Juan Pino, Wei-Ning Hsu, Ann Lee |
| 2023 | ACL | SpeechMatrix: A Large-Scale Mined Corpus of Multilingual Speech-to-Speech Translations. | Paul-Ambroise Duquenne, Hongyu Gong, Ning Dong, Jingfei Du, Ann Lee, Vedanuj Goswami, Changhan Wang, Juan Pino, Benot Sagot, Holger Schwenk |
| 2023 | ACL | UnitY: Two-pass Direct Speech-to-speech Translation with Discrete Units. | Hirofumi Inaguma, Sravya Popuri, Ilia Kulikov, Peng-Jen Chen, Changhan Wang, Yu-An Chung, Yun Tang, Ann Lee, Shinji Watanabe, Juan Pino |
| 2023 | ACL | Simple and Effective Unsupervised Speech Translation. | Changhan Wang, Hirofumi Inaguma, Peng-Jen Chen, Ilia Kulikov, Yun Tang, Wei-Ning Hsu, Michael Auli, Juan Pino |
| 2023 | ACL | Introducing Semantics into Speech Encoders. | Derek Xu, Shuyan Dong, Changhan Wang, Suyoun Kim, Zhaojiang Lin, Bing Liu, Akshat Shrivastava, Shang-Wen Li, Liang-Hsuan Tseng, Guan-Ting Lin, Alexei Baevski, Hung-yi Lee, Yizhou Sun, Wei Wang |
| 2023 | ICASSP | A Holistic Cascade System, Benchmark, and Human Evaluation Protocol for Expressive Speech-to-Speech Translation. | Wen-Chin Huang, Benjamin N. Peloquin, Justine Kao, Changhan Wang, Hongyu Gong, Elizabeth Salesky, Yossi Adi, Ann Lee, Peng-Jen Chen |
| 2023 | ICASSP | Improving Speech-to-Speech Translation Through Unlabeled Text. | Xuan-Phi Nguyen, Sravya Popuri, Changhan Wang, Yun Tang, Ilia Kulikov, Hongyu Gong |
| 2023 | ICASSP | Enhancing Speech-To-Speech Translation with Multiple TTS Targets. | Jiatong Shi, Yun Tang, Ann Lee, Hirofumi Inaguma, Changhan Wang, Juan Pino, Shinji Watanabe |
| 2023 | ICML | Pre-training for Speech Translation: CTC Meets Optimal Transport. | Phuong-Hang Le, Hongyu Gong, Changhan Wang, Juan Pino, Benjamin Lecouteux, Didier Schwab |
| 2023 | Interspeech | MuAViC: A Multilingual Audio-Visual Corpus for Robust Speech Recognition and Robust Speech-to-Text Translation. | Mohamed Anwar, Bowen Shi, Vedanuj Goswami, Wei-Ning Hsu, Juan Pino, Changhan Wang |
| 2022 | ACL | Direct Speech-to-Speech Translation With Discrete Units. | Ann Lee, Peng-Jen Chen, Changhan Wang, Jiatao Gu, Sravya Popuri, Xutai Ma, Adam Polyak, Yossi Adi, Qing He, Yun Tang, Juan Pino, Wei-Ning Hsu |
| 2022 | ACL | Unified Speech-Text Pre-training for Speech Translation and Recognition. | Yun Tang, Hongyu Gong, Ning Dong, Changhan Wang, Wei-Ning Hsu, Jiatao Gu, Alexei Baevski, Xian Li, Abdelrahman Mohamed, Michael Auli, Juan Miguel Pino |
| 2022 | ICLR | Contrastive Clustering to Mine Pseudo Parallel Data for Unsupervised Translation. | Xuan-Phi Nguyen, Hongyu Gong, Yun Tang, Changhan Wang, Philipp Koehn, Shafiq R. Joty |
| 2022 | Interspeech | XLS-R: Self-supervised Cross-lingual Speech Representation Learning at Scale. | Arun Babu, Changhan Wang, Andros Tjandra, Kushal Lakhotia, Qiantong Xu, Naman Goyal, Kritika Singh, Patrick von Platen, Yatharth Saraf, Juan Pino, Alexei Baevski, Alexis Conneau, Michael Auli |
| 2022 | Interspeech | From Start to Finish: Latency Reduction Strategies for Incremental Speech Synthesis in Simultaneous Speech-to-Speech Translation. | Danni Liu, Changhan Wang, Hongyu Gong, Xutai Ma, Yun Tang, Juan Miguel Pino |
| 2022 | Interspeech | Enhanced Direct Speech-to-Speech Translation Using Self-supervised Pre-training and Data Augmentation. | Sravya Popuri, Peng-Jen Chen, Changhan Wang, Juan Pino, Yossi Adi, Jiatao Gu, Wei-Ning Hsu, Ann Lee |
| 2022 | NAACL | Textless Speech-to-Speech Translation on Real Data. | Ann Lee, Hongyu Gong, Paul-Ambroise Duquenne, Holger Schwenk, Peng-Jen Chen, Changhan Wang, Sravya Popuri, Yossi Adi, Juan Miguel Pino, Jiatao Gu, Wei-Ning Hsu |
| 2021 | ACL | Lightweight Adapter Tuning for Multilingual Speech Translation. | Hang Le, Juan Miguel Pino, Changhan Wang, Jiatao Gu, Didier Schwab, Laurent Besacier |
| 2021 | ACL | Multilingual Speech Translation from Efficient Finetuning of Pretrained Models. | Xian Li, Changhan Wang, Yun Tang, Chau Tran, Yuqing Tang, Juan Miguel Pino, Alexei Baevski, Alexis Conneau, Michael Auli |
| 2021 | ACL | Improving Speech Translation by Understanding and Learning from the Auxiliary Text Translation Task. | Yun Tang, Juan Miguel Pino, Xian Li, Changhan Wang, Dmitriy Genzel |
| 2021 | ACL | VoxPopuli: A Large-Scale Multilingual Speech Corpus for Representation Learning, Semi-Supervised Learning and Interpretation. | Changhan Wang, Morgane Rivire, Ann Lee, Anne Wu, Chaitanya Talnikar, Daniel Haziza, Mary Williamson, Juan Miguel Pino, Emmanuel Dupoux |
| 2021 | EMNLP | fairseq S\^2: A Scalable and Integrable Speech Synthesis Toolkit. | Changhan Wang, Wei-Ning Hsu, Yossi Adi, Adam Polyak, Ann Lee, Peng-Jen Chen, Jiatao Gu, Juan Pino |
| 2021 | ICASSP | A General Multi-Task Learning Framework to Leverage Text Data for Speech to Text Tasks. | Yun Tang, Juan Miguel Pino, Changhan Wang, Xutai Ma, Dmitriy Genzel |
| 2021 | Interspeech | CoVoST 2 and Massively Multilingual Speech Translation. | Changhan Wang, Anne Wu, Jiatao Gu, Juan Pino |
| 2021 | Interspeech | Large-Scale Self- and Semi-Supervised Learning for Speech Translation. | Changhan Wang, Anne Wu, Juan Pino, Alexei Baevski, Michael Auli, Alexis Conneau |
| 2020 | AAAI | Neural Machine Translation with Byte-Level Subwords. | Changhan Wang, Kyunghyun Cho, Jiatao Gu |
| 2020 | COLING | Dual-decoder Transformer for Joint Automatic Speech Recognition and Multilingual Speech Translation. | Hang Le, Juan Miguel Pino, Changhan Wang, Jiatao Gu, Didier Schwab, Laurent Besacier |
| 2020 | EMNLP | SIMULEVAL: An Evaluation Toolkit for Simultaneous Translation. | Xutai Ma, Mohammad Javad Dousti, Changhan Wang, Jiatao Gu, Juan Miguel Pino |
| 2020 | IJCNLP | Fairseq S2T: Fast Speech-to-Text Modeling with Fairseq. | Changhan Wang, Yun Tang, Xutai Ma, Anne Wu, Dmytro Okhonko, Juan Miguel Pino |
| 2020 | Interspeech | Improving Cross-Lingual Transfer Learning for End-to-End Speech Recognition with Speech Translation. | Changhan Wang, Juan Miguel Pino, Jiatao Gu |
| 2020 | Interspeech | Self-Supervised Representations Improve End-to-End Speech Translation. | Anne Wu, Changhan Wang, Juan Miguel Pino, Jiatao Gu |
| 2020 | LREC | CoVoST: A Diverse Multilingual Speech-To-Text Translation Corpus. | Changhan Wang, Juan Miguel Pino, Anne Wu, Jiatao Gu |
| 2019 | CVPR | Does Object Recognition Work for Everyone? | Terrance DeVries, Ishan Misra, Changhan Wang, Laurens van der Maaten |
| 2019 | EMNLP | VizSeq: a visual analysis toolkit for text generation tasks. | Changhan Wang, Anirudh Jain, Danlu Chen, Jiatao Gu |
| 2018 | EMNLP | Dynamic Meta-Embeddings for Improved Sentence Representations. | Douwe Kiela, Changhan Wang, Kyunghyun Cho |