Skip to content

Alexei Baevski

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

28

Venues

8

Active years

2019–2023

Best venue rank

A*

Where they publish

Papers

28 indexed papers, newest first.

YearVenueTitleAuthors
2023ACLIntroducing Semantics into Speech Encoders.Derek Xu, Shuyan Dong, Changhan Wang, Suyoun Kim, Zhaojiang Lin, Bing Liu, Akshat Shrivastava, Shang-Wen Li, Liang-Hsuan Tseng, Guan-Ting Lin, Alexei Baevski, Hung-yi Lee, Yizhou Sun, Wei Wang
2023ASRUAv-Data2Vec: Self-Supervised Learning of Audio-Visual Speech Representations with Contextualized Target Representations.Jiachen Lian, Alexei Baevski, Wei-Ning Hsu, Michael Auli
2023EMNLPToward Joint Language Modeling for Speech Units and Text.Ju-Chieh Chou, Chung-Ming Chien, Wei-Ning Hsu, Karen Livescu, Arun Babu, Alexis Conneau, Alexei Baevski, Michael Auli
2023ICASSPMeasuring the Impact of Domain Factors in Self-Supervised Pre-Training.Ramon Sanabria, Wei-Ning Hsu, Alexei Baevski, Michael Auli
2023ICMLEfficient Self-supervised Learning with Contextualized Target Representations for Vision, Speech and Language.Alexei Baevski, Arun Babu, Wei-Ning Hsu, Michael Auli
2022ACLUnified Speech-Text Pre-training for Speech Translation and Recognition.Yun Tang, Hongyu Gong, Ning Dong, Changhan Wang, Wei-Ning Hsu, Jiatao Gu, Alexei Baevski, Xian Li, Abdelrahman Mohamed, Michael Auli, Juan Miguel Pino
2022ICASSPImproved Language Identification Through Cross-Lingual Self-Supervised Learning.Andros Tjandra, Diptanu Gon Choudhury, Frank Zhang, Kritika Singh, Alexis Conneau, Alexei Baevski, Assaf Sela, Yatharth Saraf, Michael Auli
2022ICMLdata2vec: A General Framework for Self-supervised Learning in Speech, Vision and Language.Alexei Baevski, Wei-Ning Hsu, Qiantong Xu, Arun Babu, Jiatao Gu, Michael Auli
2022InterspeechXLS-R: Self-supervised Cross-lingual Speech Representation Learning at Scale.Arun Babu, Changhan Wang, Andros Tjandra, Kushal Lakhotia, Qiantong Xu, Naman Goyal, Kritika Singh, Patrick von Platen, Yatharth Saraf, Juan Pino, Alexei Baevski, Alexis Conneau, Michael Auli
2022InterspeechSimple and Effective Unsupervised Speech Synthesis.Alexander H. Liu, Cheng-I Lai, Wei-Ning Hsu, Michael Auli, Alexei Baevski, James R. Glass
2022InterspeechWav2Vec-Aug: Improved self-supervised training with limited data.Anuroop Sriram, Michael Auli, Alexei Baevski
2022InterspeechOn-demand compute reduction with stochastic wav2vec 2.0.Apoorv Vyas, Wei-Ning Hsu, Michael Auli, Alexei Baevski
2022InterspeechSimple and Effective Zero-shot Cross-lingual Phoneme Recognition.Qiantong Xu, Alexei Baevski, Michael Auli
2021ACLMultilingual Speech Translation from Efficient Finetuning of Pretrained Models.Xian Li, Changhan Wang, Yun Tang, Chau Tran, Yuqing Tang, Juan Miguel Pino, Alexei Baevski, Alexis Conneau, Michael Auli
2021ACLReservoir Transformers.Sheng Shen, Alexei Baevski, Ari S. Morcos, Kurt Keutzer, Michael Auli, Douwe Kiela
2021ICASSPSelf-Training and Pre-Training are Complementary for Speech Recognition.Qiantong Xu, Alexei Baevski, Tatiana Likhomanenko, Paden Tomasello, Alexis Conneau, Ronan Collobert, Gabriel Synnaeve, Michael Auli
2021ICASSPA Comparison of Discrete Latent Variable Models for Speech Representation Learning.Henry Zhou, Alexei Baevski, Michael Auli
2021InterspeechUnsupervised Cross-Lingual Representation Learning for Speech Recognition.Alexis Conneau, Alexei Baevski, Ronan Collobert, Abdelrahman Mohamed, Michael Auli
2021InterspeechRobust wav2vec 2.0: Analyzing Domain Shift in Self-Supervised Pre-Training.Wei-Ning Hsu, Anuroop Sriram, Alexei Baevski, Tatiana Likhomanenko, Qiantong Xu, Vineel Pratap, Jacob Kahn, Ann Lee, Ronan Collobert, Gabriel Synnaeve, Michael Auli
2021InterspeechLarge-Scale Self- and Semi-Supervised Learning for Speech Translation.Changhan Wang, Anne Wu, Juan Pino, Alexei Baevski, Michael Auli, Alexis Conneau
2020ICASSPEffectiveness of Self-Supervised Pre-Training for ASR.Alexei Baevski, Abdelrahman Mohamed
2020ICLRvq-wav2vec: Self-Supervised Learning of Discrete Speech Representations.Alexei Baevski, Steffen Schneider, Michael Auli
2019EMNLPCloze-driven Pretraining of Self-attention Networks.Alexei Baevski, Sergey Edunov, Yinhan Liu, Luke Zettlemoyer, Michael Auli
2019ICLRAdaptive Input Representations for Neural Language Modeling.Alexei Baevski, Michael Auli
2019ICLRPay Less Attention with Lightweight and Dynamic Convolutions.Felix Wu, Angela Fan, Alexei Baevski, Yann N. Dauphin, Michael Auli
2019Interspeechwav2vec: Unsupervised Pre-Training for Speech Recognition.Steffen Schneider, Alexei Baevski, Ronan Collobert, Michael Auli
2019NAACLPre-trained language model representations for language generation.Sergey Edunov, Alexei Baevski, Michael Auli
2019NAACLfairseq: A Fast, Extensible Toolkit for Sequence Modeling.Myle Ott, Sergey Edunov, Alexei Baevski, Angela Fan, Sam Gross, Nathan Ng, David Grangier, Michael Auli