Skip to content

Mohammad Shoeybi

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

29

Venues

8

Active years

2017–2026

Best venue rank

A*

Where they publish

Papers

29 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLFrom 128K to 4M: Efficient Training of Ultra-Long Context Large Language Models.Chejian Xu, Wei Ping, Peng Xu, Zihan Liu, Boxin Wang, Mohammad Shoeybi, Bo Li, Bryan Catanzaro
2026EACLNemotron-CrossThink: Scaling Self-Learning beyond Math Reasoning.Syeda Nahida Akter, Shrimai Prabhumoye, Matvei Novikov, Seungju Han, Ying Lin, Evelina Bakhturina, Eric Nyberg, Yejin Choi, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro
2025ACLNemotron-CC: Transforming Common Crawl into a Refined Long-Horizon Pretraining Dataset.Dan Su, Kezhi Kong, Ying Lin, Joseph Jennings, Brandon Norick, Markus Kliegl, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro
2025ACLAceMath: Advancing Frontier Math Reasoning with Post-Training and Reward Modeling.Zihan Liu, Yang Chen, Mohammad Shoeybi, Bryan Catanzaro, Wei Ping
2025ICLRMIND: Math Informed syNthetic Dialogues for Pretraining LLMs.Syeda Nahida Akter, Shrimai Prabhumoye, John Kamalu, Sanjeev Satheesh, Eric Nyberg, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro
2025ICLRNV-Embed: Improved Techniques for Training LLMs as Generalist Embedding Models.Chankyu Lee, Rajarshi Roy, Mengyao Xu, Jonathan Raiman, Mohammad Shoeybi, Bryan Catanzaro, Wei Ping
2025ICLRMm-Embed: Universal Multimodal Retrieval with Multimodal LLMS.Sheng-Chieh Lin, Chankyu Lee, Mohammad Shoeybi, Jimmy Lin, Bryan Catanzaro, Wei Ping
2025ICLRChatQA 2: Bridging the Gap to Proprietary LLMs in Long Context and RAG Capabilities.Peng Xu, Wei Ping, Xianchao Wu, Chejian Xu, Zihan Liu, Mohammad Shoeybi, Bryan Catanzaro
2024CVPRVILA: On Pre-training for Visual Language Models.Ji Lin, Hongxu Yin, Wei Ping, Pavlo Molchanov, Mohammad Shoeybi, Song Han
2024EMNLPData, Data Everywhere: A Guide for Pretraining Dataset Construction.Jupinder Parmar, Shrimai Prabhumoye, Joseph Jennings, Bo Liu, Aastha Jhunjhunwala, Zhilin Wang, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro
2024EMNLPLLM-Evolve: Evaluation for LLM's Evolving Capability on Benchmarks.Jiaxuan You, Mingjie Liu, Shrimai Prabhumoye, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro
2024ICLRRetrieval meets Long Context Large Language Models.Peng Xu, Wei Ping, Xianchao Wu, Lawrence McAfee, Chen Zhu, Zihan Liu, Sandeep Subramanian, Evelina Bakhturina, Mohammad Shoeybi, Bryan Catanzaro
2024ICMLODIN: Disentangled Reward Mitigates Hacking in RLHF.Lichang Chen, Chen Zhu, Jiuhai Chen, Davit Soselia, Tianyi Zhou, Tom Goldstein, Heng Huang, Mohammad Shoeybi, Bryan Catanzaro
2024ICMLInstructRetro: Instruction Tuning post Retrieval-Augmented Pretraining.Boxin Wang, Wei Ping, Lawrence McAfee, Peng Xu, Bo Li, Mohammad Shoeybi, Bryan Catanzaro
2023EACLAdding Instructions during Pretraining: Effective way of Controlling Toxicity in Language Models.Shrimai Prabhumoye, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro
2023EACLContext Generation Improves Open Domain Question Answering.Dan Su, Mostofa Patwary, Shrimai Prabhumoye, Peng Xu, Ryan Prenger, Mohammad Shoeybi, Pascale Fung, Anima Anandkumar, Bryan Catanzaro
2023EMNLPShall We Pretrain Autoregressive Language Models with Retrieval? A Comprehensive Study.Boxin Wang, Wei Ping, Peng Xu, Lawrence McAfee, Zihan Liu, Mohammad Shoeybi, Yi Dong, Oleksii Kuchaiev, Bo Li, Chaowei Xiao, Anima Anandkumar, Bryan Catanzaro
2023EMNLPRe-ViLM: Retrieval-Augmented Visual Language Model for Zero and Few-Shot Image Captioning.Zhuolin Yang, Wei Ping, Zihan Liu, Vijay Korthikanti, Weili Nie, De-An Huang, Linxi Fan, Zhiding Yu, Shiyi Lan, Bo Li, Mohammad Shoeybi, Ming-Yu Liu, Yuke Zhu, Bryan Catanzaro, Chaowei Xiao, Anima Anandkumar
2022ACLMulti-Stage Prompting for Knowledgeable Dialogue Generation.Zihan Liu, Mostofa Patwary, Ryan Prenger, Shrimai Prabhumoye, Wei Ping, Mohammad Shoeybi, Bryan Catanzaro
2022EMNLPEvaluating Parameter Efficient Learning for Generation.Peng Xu, Mostofa Patwary, Shrimai Prabhumoye, Virginia Adams, Ryan Prenger, Wei Ping, Nayeon Lee, Mohammad Shoeybi, Bryan Catanzaro
2022EMNLPPrompt Compression and Contrastive Conditioning for Controllability and Toxicity Reduction in Language Models.David Wingate, Mohammad Shoeybi, Taylor Sorensen
2021ACLEnd-to-End Training of Neural Retrievers for Open-Domain Question Answering.Devendra Singh Sachan, Mostofa Patwary, Mohammad Shoeybi, Neel Kant, Wei Ping, William L. Hamilton, Bryan Catanzaro
2021SCEfficient large-scale language model training on GPU clusters using megatron-LM.Deepak Narayanan, Mohammad Shoeybi, Jared Casper, Patrick LeGresley, Mostofa Patwary, Vijay Korthikanti, Dmitri Vainbrand, Prethvi Kashinkunti, Julie Bernauer, Bryan Catanzaro, Amar Phanishayee, Matei Zaharia
2020ACLLarge Scale Multi-Actor Generative Dialog Modeling.Alex Boyd, Raul Puri, Mohammad Shoeybi, Mostofa Patwary, Bryan Catanzaro
2020EMNLPTraining Question Answering Models From Synthetic Data.Raul Puri, Ryan Spring, Mohammad Shoeybi, Mostofa Patwary, Bryan Catanzaro
2020EMNLPBioMegatron: Larger Biomedical Domain Language Model.Hoo-Chang Shin, Yang Zhang, Evelina Bakhturina, Raul Puri, Mostofa Patwary, Mohammad Shoeybi, Raghav Mani
2020EMNLPMEGATRON-CNTRL: Controllable Story Generation with External Knowledge Using Large-Scale Language Models.Peng Xu, Mostofa Patwary, Mohammad Shoeybi, Raul Puri, Pascale Fung, Anima Anandkumar, Bryan Catanzaro
2019ICCVUnsupervised Video Interpolation Using Cycle Consistency.Fitsum A. Reda, Deqing Sun, Aysegul Dundar, Mohammad Shoeybi, Guilin Liu, Kevin J. Shih, Andrew Tao, Jan Kautz, Bryan Catanzaro
2017ICMLDeep Voice: Real-time Neural Text-to-Speech.Sercan mer Arik, Mike Chrzanowski, Adam Coates, Gregory Frederick Diamos, Andrew Gibiansky, Yongguo Kang, Xian Li, John Miller, Andrew Y. Ng, Jonathan Raiman, Shubho Sengupta, Mohammad Shoeybi