Abdelrahman Mohamed
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
46
Venues
10
Active years
2015–2026
Best venue rank
A*
Where they publish
Papers
46 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | VoiceStar: Robust Zero-Shot Autoregressive TTS with Duration Control and Extrapolation. | Puyuan Peng, Zhisheng Zheng, Shang-Wen Li, Abdelrahman Mohamed, David Harwath |
| 2026 | EACL | JEEM: Vision-Language Understanding in Four Arabic Dialects. | Karima Kadaoui, Hanin Atwany, Hamdan Al-Ali, Abdelrahman Mohamed, Ali Mekky, Sergei Tilga, Natalia Fedorova, Ekaterina Artemova, Hanan Aldarmaki, Yova Kementchedjhieva |
| 2025 | EMNLP | LLMs Can Compensate for Deficiencies in Visual Representations. | Sho Takishita, Jay P. Gala, Abdelrahman Mohamed, Kentaro Inui, Yova Kementchedjhieva |
| 2025 | ICCV | $f$ COP: Monocular Focal Length Estimation from Category-Level Object Priors. | Xinyue Zhang, Jiaqi Yang, Xiangting Meng, Abdelrahman Mohamed, Laurent Kneip |
| 2024 | ACL | Peacock: A Family of Arabic Multimodal Large Language Models and Benchmarks. | Fakhraddin Alwajih, El Moatez Billah Nagoudi, Gagan Bhatia, Abdelrahman Mohamed, Muhammad Abdul-Mageed |
| 2024 | ACL | VoiceCraft: Zero-Shot Speech Editing and Text-to-Speech in the Wild. | Puyuan Peng, Po-Yao Huang, Shang-Wen Li, Abdelrahman Mohamed, David Harwath |
| 2024 | EMNLP | Casablanca: Data and Models for Multidialectal Arabic Speech Recognition. | Bashar Talafha, Karima Kadaoui, Samar Mohamed Magdy, Mariem Habiboullah, Chafei Mohamed Chafei, Ahmed Oumar El-Shangiti, Hiba Zayed, Mohamedou Cheikh Tourad, Rahaf Alhamouri, Rwaa Assi, Aisha Alraeesi, Hour Mohamed, Fakhraddin Alwajih, Abdelrahman Mohamed, Abdellah El Mekki, El Moatez Billah Nagoudi, Benelhadj Saadia, Hamzah A. Alsayadi, Walid Al-Dhabyani, Sara Shatnawi, Yasir Ech-Chammakhy, Amal Makouar, Yousra Berrachedi, Mustafa Jarrar, Shady Shehata, Ismail Berrada, Muhammad Abdul-Mageed |
| 2024 | ICASSP | SD-HuBERT: Sentence-Level Self-Distillation Induces Syllabic Organization in Hubert. | Cheol Jun Cho, Abdelrahman Mohamed, Shang-Wen Li, Alan W. Black, Gopala Krishna Anumanchipalli |
| 2024 | ICASSP | Self-Supervised Models of Speech Infer Universal Articulatory Kinematics. | Cheol Jun Cho, Abdelrahman Mohamed, Alan W. Black, Gopala Krishna Anumanchipalli |
| 2024 | ICASSP | SpeechDPR: End-To-End Spoken Passage Retrieval For Open-Domain Spoken Question Answering. | Chyi-Jiunn Lin, Guan-Ting Lin, Yung-Sung Chuang, Wei-Lun Wu, Shang-Wen Li, Abdelrahman Mohamed, Hung-Yi Lee, Lin-Shan Lee |
| 2024 | ICASSP | AV-SUPERB: A Multi-Task Evaluation Benchmark for Audio-Visual Representation Models. | Yuan Tseng, Layne Berry, Yiting Chen, I-Hsiang Chiu, Hsuan-Hao Lin, Max Liu, Puyuan Peng, Yi-Jen Shih, Hung-Yu Wang, Haibin Wu, Poyao Huang, Chun-Mao Lai, Shang-Wen Li, David Harwath, Yu Tsao, Abdelrahman Mohamed, Chi-Luen Feng, Hung-Yi Lee |
| 2023 | ASRU | Findings of the 2023 ML-Superb Challenge: Pre-Training And Evaluation Over More Languages And Beyond. | Jiatong Shi, William Chen, Dan Berrebbi, Hsiu-Hsuan Wang, Wei-Ping Huang, En-Pei Hu, Ho-Lam Chuang, Xuankai Chang, Yuxun Tang, Shang-Wen Li, Abdelrahman Mohamed, Hung-Yi Lee, Shinji Watanabe |
| 2023 | CVPR | D | Abdelrahman Mohamed, Rushali Grandhe, K. J. Joseph, Salman H. Khan, Fahad Shahbaz Khan |
| 2023 | ICASSP | Evidence of Vocal Tract Articulation in Self-Supervised Learning of Speech. | Cheol Jun Cho, Peter Wu, Abdelrahman Mohamed, Gopala Krishna Anumanchipalli |
| 2023 | ICASSP | Continual Learning for On-Device Speech Recognition Using Disentangled Conformers. | Anuj Diwan, Ching-Feng Yeh, Wei-Ning Hsu, Paden Tomasello, Eunsol Choi, David Harwath, Abdelrahman Mohamed |
| 2023 | ICASSP | Do Coarser Units Benefit Cluster Prediction-Based Speech Pre-Training? | Ali Elkahky, Wei-Ning Hsu, Paden Tomasello, Tu Anh Nguyen, Robin Algayres, Yossi Adi, Jade Copet, Emmanuel Dupoux, Abdelrahman Mohamed |
| 2023 | ICASSP | Massively Multilingual ASR on 70 Languages: Tokenization, Architecture, and Generalization Capabilities. | Andros Tjandra, Nayan Singhal, David Zhang, Ozlem Kalinli, Abdelrahman Mohamed, Duc Le, Michael L. Seltzer |
| 2023 | Interspeech | Syllable Discovery and Cross-Lingual Generalization in a Visually Grounded, Self-Supervised Speech Model. | Puyuan Peng, Shang-Wen Li, Okko Rsnen, Abdelrahman Mohamed, David Harwath |
| 2023 | Interspeech | ML-SUPERB: Multilingual Speech Universal PERformance Benchmark. | Jiatong Shi, Dan Berrebbi, William Chen, En-Pei Hu, Wei-Ping Huang, Ho-Lam Chung, Xuankai Chang, Shang-Wen Li, Abdelrahman Mohamed, Hung-yi Lee, Shinji Watanabe |
| 2022 | ACL | Text-Free Prosody-Aware Generative Spoken Language Modeling. | Eugene Kharitonov, Ann Lee, Adam Polyak, Yossi Adi, Jade Copet, Kushal Lakhotia, Tu Anh Nguyen, Morgane Rivire, Abdelrahman Mohamed, Emmanuel Dupoux, Wei-Ning Hsu |
| 2022 | ACL | Unified Speech-Text Pre-training for Speech Translation and Recognition. | Yun Tang, Hongyu Gong, Ning Dong, Changhan Wang, Wei-Ning Hsu, Jiatao Gu, Alexei Baevski, Xian Li, Abdelrahman Mohamed, Michael Auli, Juan Miguel Pino |
| 2022 | ACL | SUPERB-SG: Enhanced Speech processing Universal PERformance Benchmark for Semantic and Generative Capabilities. | Hsiang-Sheng Tsai, Heng-Jui Chang, Wen-Chin Huang, Zili Huang, Kushal Lakhotia, Shu-Wen Yang, Shuyan Dong, Andy T. Liu, Cheng-I Lai, Jiatong Shi, Xuankai Chang, Phil Hall, Hsuan-Jui Chen, Shang-Wen Li, Shinji Watanabe, Abdelrahman Mohamed, Hung-yi Lee |
| 2022 | EMNLP | Textless Speech Emotion Conversion using Discrete & Decomposed Representations. | Felix Kreuk, Adam Polyak, Jade Copet, Eugene Kharitonov, Tu Anh Nguyen, Morgane Rivire, Wei-Ning Hsu, Abdelrahman Mohamed, Emmanuel Dupoux, Yossi Adi |
| 2022 | ICLR | Learning Audio-Visual Speech Representation by Masked Multimodal Cluster Prediction. | Bowen Shi, Wei-Ning Hsu, Kushal Lakhotia, Abdelrahman Mohamed |
| 2022 | ICML | Federated Learning with Partial Model Personalization. | Krishna Pillutla, Kshitiz Malik, Abdelrahman Mohamed, Michael G. Rabbat, Maziar Sanjabi, Lin Xiao |
| 2022 | Interspeech | DUAL: Discrete Spoken Unit Adaptive Learning for Textless Spoken Question Answering. | Guan-Ting Lin, Yung-Sung Chuang, Ho-Lam Chung, Shu-Wen Yang, Hsuan-Jui Chen, Shuyan Annie Dong, Shang-Wen Li, Abdelrahman Mohamed, Hung-yi Lee, Lin-Shan Lee |
| 2022 | Interspeech | Robust Self-Supervised Audio-Visual Speech Recognition. | Bowen Shi, Wei-Ning Hsu, Abdelrahman Mohamed |
| 2022 | Interspeech | Learning Lip-Based Audio-Visual Speaker Embeddings with AV-HuBERT. | Bowen Shi, Abdelrahman Mohamed, Wei-Ning Hsu |
| 2022 | Interspeech | Scaling ASR Improves Zero and Few Shot Learning. | Weiyi Zheng, Alex Xiao, Gil Keren, Duc Le, Frank Zhang, Christian Fuegen, Ozlem Kalinli, Yatharth Saraf, Abdelrahman Mohamed |
| 2021 | ASRU | Kaizen: Continuously Improving Teacher Using Exponential Moving Average for Semi-Supervised Speech Recognition. | Vimal Manohar, Tatiana Likhomanenko, Qiantong Xu, Wei-Ning Hsu, Ronan Collobert, Yatharth Saraf, Geoffrey Zweig, Abdelrahman Mohamed |
| 2021 | ICASSP | Hubert: How Much Can a Bad Teacher Benefit ASR Pre-Training? | Wei-Ning Hsu, Yao-Hung Hubert Tsai, Benjamin Bolte, Ruslan Salakhutdinov, Abdelrahman Mohamed |
| 2021 | ICASSP | Contrastive Semi-Supervised Learning for ASR. | Alex Xiao, Christian Fuegen, Abdelrahman Mohamed |
| 2021 | Interspeech | Unsupervised Cross-Lingual Representation Learning for Speech Recognition. | Alexis Conneau, Alexei Baevski, Ronan Collobert, Abdelrahman Mohamed, Michael Auli |
| 2021 | Interspeech | Speech Resynthesis from Discrete Disentangled Self-Supervised Representations. | Adam Polyak, Yossi Adi, Jade Copet, Eugene Kharitonov, Kushal Lakhotia, Wei-Ning Hsu, Abdelrahman Mohamed, Emmanuel Dupoux |
| 2021 | Interspeech | SUPERB: Speech Processing Universal PERformance Benchmark. | Shu-Wen Yang, Po-Han Chi, Yung-Sung Chuang, Cheng-I Jeff Lai, Kushal Lakhotia, Yist Y. Lin, Andy T. Liu, Jiatong Shi, Xuankai Chang, Guan-Ting Lin, Tzu-Hsien Huang, Wei-Cheng Tseng, Ko-tik Lee, Da-Rong Liu, Zili Huang, Shuyan Dong, Shang-Wen Li, Shinji Watanabe, Abdelrahman Mohamed, Hung-yi Lee |
| 2020 | ACL | BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension. | Mike Lewis, Yinhan Liu, Naman Goyal, Marjan Ghazvininejad, Abdelrahman Mohamed, Omer Levy, Veselin Stoyanov, Luke Zettlemoyer |
| 2020 | ICASSP | Effectiveness of Self-Supervised Pre-Training for ASR. | Alexei Baevski, Abdelrahman Mohamed |
| 2020 | ICASSP | Libri-Light: A Benchmark for ASR with Limited or No Supervision. | Jacob Kahn, Morgane Rivire, Weiyi Zheng, Evgeny Kharitonov, Qiantong Xu, Pierre-Emmanuel Mazar, Julien Karadayi, Vitaliy Liptchinsky, Ronan Collobert, Christian Fuegen, Tatiana Likhomanenko, Gabriel Synnaeve, Armand Joulin, Abdelrahman Mohamed, Emmanuel Dupoux |
| 2020 | ICASSP | Training ASR Models By Generation of Contextual Information. | Kritika Singh, Dmytro Okhonko, Jun Liu, Yongqiang Wang, Frank Zhang, Ross B. Girshick, Sergey Edunov, Fuchun Peng, Yatharth Saraf, Geoffrey Zweig, Abdelrahman Mohamed |
| 2020 | ICASSP | Transformer-Based Acoustic Modeling for Hybrid Speech Recognition. | Yongqiang Wang, Abdelrahman Mohamed, Duc Le, Chunxi Liu, Alex Xiao, Jay Mahadeokar, Hongzhao Huang, Andros Tjandra, Xiaohui Zhang, Frank Zhang, Christian Fuegen, Geoffrey Zweig, Michael L. Seltzer |
| 2020 | Interspeech | Large Scale Weakly and Semi-Supervised Learning for Low-Resource Video ASR. | Kritika Singh, Vimal Manohar, Alex Xiao, Sergey Edunov, Ross B. Girshick, Vitaliy Liptchinsky, Christian Fuegen, Yatharth Saraf, Geoffrey Zweig, Abdelrahman Mohamed |
| 2017 | ICLR | Do Deep Convolutional Nets Really Need to be Deep and Convolutional? | Gregor Urban, Krzysztof J. Geras, Samira Ebrahimi Kahou, zlem Aslan, Shengjie Wang, Abdelrahman Mohamed, Matthai Philipose, Matthew Richardson, Rich Caruana |
| 2017 | ICML | Sequence Modeling via Segmentations. | Chong Wang, Yining Wang, Po-Sen Huang, Abdelrahman Mohamed, Dengyong Zhou, Li Deng |
| 2016 | ICASSP | Exploring multidimensional lstms for large vocabulary ASR. | Jinyu Li, Abdelrahman Mohamed, Geoffrey Zweig, Yifan Gong |
| 2015 | ACL | Learning Lexical Embeddings with Syntactic and Lexicographic Knowledge. | Tong Wang, Abdelrahman Mohamed, Graeme Hirst |
| 2015 | ASRU | LSTM time and frequency recurrence for automatic speech recognition. | Jinyu Li, Abdelrahman Mohamed, Geoffrey Zweig, Yifan Gong |