Skip to content

Abdelrahman Mohamed

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

46

Venues

10

Active years

2015–2026

Best venue rank

A*

Where they publish

Papers

46 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLVoiceStar: Robust Zero-Shot Autoregressive TTS with Duration Control and Extrapolation.Puyuan Peng, Zhisheng Zheng, Shang-Wen Li, Abdelrahman Mohamed, David Harwath
2026EACLJEEM: Vision-Language Understanding in Four Arabic Dialects.Karima Kadaoui, Hanin Atwany, Hamdan Al-Ali, Abdelrahman Mohamed, Ali Mekky, Sergei Tilga, Natalia Fedorova, Ekaterina Artemova, Hanan Aldarmaki, Yova Kementchedjhieva
2025EMNLPLLMs Can Compensate for Deficiencies in Visual Representations.Sho Takishita, Jay P. Gala, Abdelrahman Mohamed, Kentaro Inui, Yova Kementchedjhieva
2025ICCV$f$ COP: Monocular Focal Length Estimation from Category-Level Object Priors.Xinyue Zhang, Jiaqi Yang, Xiangting Meng, Abdelrahman Mohamed, Laurent Kneip
2024ACLPeacock: A Family of Arabic Multimodal Large Language Models and Benchmarks.Fakhraddin Alwajih, El Moatez Billah Nagoudi, Gagan Bhatia, Abdelrahman Mohamed, Muhammad Abdul-Mageed
2024ACLVoiceCraft: Zero-Shot Speech Editing and Text-to-Speech in the Wild.Puyuan Peng, Po-Yao Huang, Shang-Wen Li, Abdelrahman Mohamed, David Harwath
2024EMNLPCasablanca: Data and Models for Multidialectal Arabic Speech Recognition.Bashar Talafha, Karima Kadaoui, Samar Mohamed Magdy, Mariem Habiboullah, Chafei Mohamed Chafei, Ahmed Oumar El-Shangiti, Hiba Zayed, Mohamedou Cheikh Tourad, Rahaf Alhamouri, Rwaa Assi, Aisha Alraeesi, Hour Mohamed, Fakhraddin Alwajih, Abdelrahman Mohamed, Abdellah El Mekki, El Moatez Billah Nagoudi, Benelhadj Saadia, Hamzah A. Alsayadi, Walid Al-Dhabyani, Sara Shatnawi, Yasir Ech-Chammakhy, Amal Makouar, Yousra Berrachedi, Mustafa Jarrar, Shady Shehata, Ismail Berrada, Muhammad Abdul-Mageed
2024ICASSPSD-HuBERT: Sentence-Level Self-Distillation Induces Syllabic Organization in Hubert.Cheol Jun Cho, Abdelrahman Mohamed, Shang-Wen Li, Alan W. Black, Gopala Krishna Anumanchipalli
2024ICASSPSelf-Supervised Models of Speech Infer Universal Articulatory Kinematics.Cheol Jun Cho, Abdelrahman Mohamed, Alan W. Black, Gopala Krishna Anumanchipalli
2024ICASSPSpeechDPR: End-To-End Spoken Passage Retrieval For Open-Domain Spoken Question Answering.Chyi-Jiunn Lin, Guan-Ting Lin, Yung-Sung Chuang, Wei-Lun Wu, Shang-Wen Li, Abdelrahman Mohamed, Hung-Yi Lee, Lin-Shan Lee
2024ICASSPAV-SUPERB: A Multi-Task Evaluation Benchmark for Audio-Visual Representation Models.Yuan Tseng, Layne Berry, Yiting Chen, I-Hsiang Chiu, Hsuan-Hao Lin, Max Liu, Puyuan Peng, Yi-Jen Shih, Hung-Yu Wang, Haibin Wu, Poyao Huang, Chun-Mao Lai, Shang-Wen Li, David Harwath, Yu Tsao, Abdelrahman Mohamed, Chi-Luen Feng, Hung-Yi Lee
2023ASRUFindings of the 2023 ML-Superb Challenge: Pre-Training And Evaluation Over More Languages And Beyond.Jiatong Shi, William Chen, Dan Berrebbi, Hsiu-Hsuan Wang, Wei-Ping Huang, En-Pei Hu, Ho-Lam Chuang, Xuankai Chang, Yuxun Tang, Shang-Wen Li, Abdelrahman Mohamed, Hung-Yi Lee, Shinji Watanabe
2023CVPRDAbdelrahman Mohamed, Rushali Grandhe, K. J. Joseph, Salman H. Khan, Fahad Shahbaz Khan
2023ICASSPEvidence of Vocal Tract Articulation in Self-Supervised Learning of Speech.Cheol Jun Cho, Peter Wu, Abdelrahman Mohamed, Gopala Krishna Anumanchipalli
2023ICASSPContinual Learning for On-Device Speech Recognition Using Disentangled Conformers.Anuj Diwan, Ching-Feng Yeh, Wei-Ning Hsu, Paden Tomasello, Eunsol Choi, David Harwath, Abdelrahman Mohamed
2023ICASSPDo Coarser Units Benefit Cluster Prediction-Based Speech Pre-Training?Ali Elkahky, Wei-Ning Hsu, Paden Tomasello, Tu Anh Nguyen, Robin Algayres, Yossi Adi, Jade Copet, Emmanuel Dupoux, Abdelrahman Mohamed
2023ICASSPMassively Multilingual ASR on 70 Languages: Tokenization, Architecture, and Generalization Capabilities.Andros Tjandra, Nayan Singhal, David Zhang, Ozlem Kalinli, Abdelrahman Mohamed, Duc Le, Michael L. Seltzer
2023InterspeechSyllable Discovery and Cross-Lingual Generalization in a Visually Grounded, Self-Supervised Speech Model.Puyuan Peng, Shang-Wen Li, Okko Rsnen, Abdelrahman Mohamed, David Harwath
2023InterspeechML-SUPERB: Multilingual Speech Universal PERformance Benchmark.Jiatong Shi, Dan Berrebbi, William Chen, En-Pei Hu, Wei-Ping Huang, Ho-Lam Chung, Xuankai Chang, Shang-Wen Li, Abdelrahman Mohamed, Hung-yi Lee, Shinji Watanabe
2022ACLText-Free Prosody-Aware Generative Spoken Language Modeling.Eugene Kharitonov, Ann Lee, Adam Polyak, Yossi Adi, Jade Copet, Kushal Lakhotia, Tu Anh Nguyen, Morgane Rivire, Abdelrahman Mohamed, Emmanuel Dupoux, Wei-Ning Hsu
2022ACLUnified Speech-Text Pre-training for Speech Translation and Recognition.Yun Tang, Hongyu Gong, Ning Dong, Changhan Wang, Wei-Ning Hsu, Jiatao Gu, Alexei Baevski, Xian Li, Abdelrahman Mohamed, Michael Auli, Juan Miguel Pino
2022ACLSUPERB-SG: Enhanced Speech processing Universal PERformance Benchmark for Semantic and Generative Capabilities.Hsiang-Sheng Tsai, Heng-Jui Chang, Wen-Chin Huang, Zili Huang, Kushal Lakhotia, Shu-Wen Yang, Shuyan Dong, Andy T. Liu, Cheng-I Lai, Jiatong Shi, Xuankai Chang, Phil Hall, Hsuan-Jui Chen, Shang-Wen Li, Shinji Watanabe, Abdelrahman Mohamed, Hung-yi Lee
2022EMNLPTextless Speech Emotion Conversion using Discrete & Decomposed Representations.Felix Kreuk, Adam Polyak, Jade Copet, Eugene Kharitonov, Tu Anh Nguyen, Morgane Rivire, Wei-Ning Hsu, Abdelrahman Mohamed, Emmanuel Dupoux, Yossi Adi
2022ICLRLearning Audio-Visual Speech Representation by Masked Multimodal Cluster Prediction.Bowen Shi, Wei-Ning Hsu, Kushal Lakhotia, Abdelrahman Mohamed
2022ICMLFederated Learning with Partial Model Personalization.Krishna Pillutla, Kshitiz Malik, Abdelrahman Mohamed, Michael G. Rabbat, Maziar Sanjabi, Lin Xiao
2022InterspeechDUAL: Discrete Spoken Unit Adaptive Learning for Textless Spoken Question Answering.Guan-Ting Lin, Yung-Sung Chuang, Ho-Lam Chung, Shu-Wen Yang, Hsuan-Jui Chen, Shuyan Annie Dong, Shang-Wen Li, Abdelrahman Mohamed, Hung-yi Lee, Lin-Shan Lee
2022InterspeechRobust Self-Supervised Audio-Visual Speech Recognition.Bowen Shi, Wei-Ning Hsu, Abdelrahman Mohamed
2022InterspeechLearning Lip-Based Audio-Visual Speaker Embeddings with AV-HuBERT.Bowen Shi, Abdelrahman Mohamed, Wei-Ning Hsu
2022InterspeechScaling ASR Improves Zero and Few Shot Learning.Weiyi Zheng, Alex Xiao, Gil Keren, Duc Le, Frank Zhang, Christian Fuegen, Ozlem Kalinli, Yatharth Saraf, Abdelrahman Mohamed
2021ASRUKaizen: Continuously Improving Teacher Using Exponential Moving Average for Semi-Supervised Speech Recognition.Vimal Manohar, Tatiana Likhomanenko, Qiantong Xu, Wei-Ning Hsu, Ronan Collobert, Yatharth Saraf, Geoffrey Zweig, Abdelrahman Mohamed
2021ICASSPHubert: How Much Can a Bad Teacher Benefit ASR Pre-Training?Wei-Ning Hsu, Yao-Hung Hubert Tsai, Benjamin Bolte, Ruslan Salakhutdinov, Abdelrahman Mohamed
2021ICASSPContrastive Semi-Supervised Learning for ASR.Alex Xiao, Christian Fuegen, Abdelrahman Mohamed
2021InterspeechUnsupervised Cross-Lingual Representation Learning for Speech Recognition.Alexis Conneau, Alexei Baevski, Ronan Collobert, Abdelrahman Mohamed, Michael Auli
2021InterspeechSpeech Resynthesis from Discrete Disentangled Self-Supervised Representations.Adam Polyak, Yossi Adi, Jade Copet, Eugene Kharitonov, Kushal Lakhotia, Wei-Ning Hsu, Abdelrahman Mohamed, Emmanuel Dupoux
2021InterspeechSUPERB: Speech Processing Universal PERformance Benchmark.Shu-Wen Yang, Po-Han Chi, Yung-Sung Chuang, Cheng-I Jeff Lai, Kushal Lakhotia, Yist Y. Lin, Andy T. Liu, Jiatong Shi, Xuankai Chang, Guan-Ting Lin, Tzu-Hsien Huang, Wei-Cheng Tseng, Ko-tik Lee, Da-Rong Liu, Zili Huang, Shuyan Dong, Shang-Wen Li, Shinji Watanabe, Abdelrahman Mohamed, Hung-yi Lee
2020ACLBART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension.Mike Lewis, Yinhan Liu, Naman Goyal, Marjan Ghazvininejad, Abdelrahman Mohamed, Omer Levy, Veselin Stoyanov, Luke Zettlemoyer
2020ICASSPEffectiveness of Self-Supervised Pre-Training for ASR.Alexei Baevski, Abdelrahman Mohamed
2020ICASSPLibri-Light: A Benchmark for ASR with Limited or No Supervision.Jacob Kahn, Morgane Rivire, Weiyi Zheng, Evgeny Kharitonov, Qiantong Xu, Pierre-Emmanuel Mazar, Julien Karadayi, Vitaliy Liptchinsky, Ronan Collobert, Christian Fuegen, Tatiana Likhomanenko, Gabriel Synnaeve, Armand Joulin, Abdelrahman Mohamed, Emmanuel Dupoux
2020ICASSPTraining ASR Models By Generation of Contextual Information.Kritika Singh, Dmytro Okhonko, Jun Liu, Yongqiang Wang, Frank Zhang, Ross B. Girshick, Sergey Edunov, Fuchun Peng, Yatharth Saraf, Geoffrey Zweig, Abdelrahman Mohamed
2020ICASSPTransformer-Based Acoustic Modeling for Hybrid Speech Recognition.Yongqiang Wang, Abdelrahman Mohamed, Duc Le, Chunxi Liu, Alex Xiao, Jay Mahadeokar, Hongzhao Huang, Andros Tjandra, Xiaohui Zhang, Frank Zhang, Christian Fuegen, Geoffrey Zweig, Michael L. Seltzer
2020InterspeechLarge Scale Weakly and Semi-Supervised Learning for Low-Resource Video ASR.Kritika Singh, Vimal Manohar, Alex Xiao, Sergey Edunov, Ross B. Girshick, Vitaliy Liptchinsky, Christian Fuegen, Yatharth Saraf, Geoffrey Zweig, Abdelrahman Mohamed
2017ICLRDo Deep Convolutional Nets Really Need to be Deep and Convolutional?Gregor Urban, Krzysztof J. Geras, Samira Ebrahimi Kahou, zlem Aslan, Shengjie Wang, Abdelrahman Mohamed, Matthai Philipose, Matthew Richardson, Rich Caruana
2017ICMLSequence Modeling via Segmentations.Chong Wang, Yining Wang, Po-Sen Huang, Abdelrahman Mohamed, Dengyong Zhou, Li Deng
2016ICASSPExploring multidimensional lstms for large vocabulary ASR.Jinyu Li, Abdelrahman Mohamed, Geoffrey Zweig, Yifan Gong
2015ACLLearning Lexical Embeddings with Syntactic and Lexicographic Knowledge.Tong Wang, Abdelrahman Mohamed, Graeme Hirst
2015ASRULSTM time and frequency recurrence for automatic speech recognition.Jinyu Li, Abdelrahman Mohamed, Geoffrey Zweig, Yifan Gong