Mohammad Shoeybi
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
29
Venues
8
Active years
2017–2026
Best venue rank
A*
Where they publish
Papers
29 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | From 128K to 4M: Efficient Training of Ultra-Long Context Large Language Models. | Chejian Xu, Wei Ping, Peng Xu, Zihan Liu, Boxin Wang, Mohammad Shoeybi, Bo Li, Bryan Catanzaro |
| 2026 | EACL | Nemotron-CrossThink: Scaling Self-Learning beyond Math Reasoning. | Syeda Nahida Akter, Shrimai Prabhumoye, Matvei Novikov, Seungju Han, Ying Lin, Evelina Bakhturina, Eric Nyberg, Yejin Choi, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro |
| 2025 | ACL | Nemotron-CC: Transforming Common Crawl into a Refined Long-Horizon Pretraining Dataset. | Dan Su, Kezhi Kong, Ying Lin, Joseph Jennings, Brandon Norick, Markus Kliegl, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro |
| 2025 | ACL | AceMath: Advancing Frontier Math Reasoning with Post-Training and Reward Modeling. | Zihan Liu, Yang Chen, Mohammad Shoeybi, Bryan Catanzaro, Wei Ping |
| 2025 | ICLR | MIND: Math Informed syNthetic Dialogues for Pretraining LLMs. | Syeda Nahida Akter, Shrimai Prabhumoye, John Kamalu, Sanjeev Satheesh, Eric Nyberg, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro |
| 2025 | ICLR | NV-Embed: Improved Techniques for Training LLMs as Generalist Embedding Models. | Chankyu Lee, Rajarshi Roy, Mengyao Xu, Jonathan Raiman, Mohammad Shoeybi, Bryan Catanzaro, Wei Ping |
| 2025 | ICLR | Mm-Embed: Universal Multimodal Retrieval with Multimodal LLMS. | Sheng-Chieh Lin, Chankyu Lee, Mohammad Shoeybi, Jimmy Lin, Bryan Catanzaro, Wei Ping |
| 2025 | ICLR | ChatQA 2: Bridging the Gap to Proprietary LLMs in Long Context and RAG Capabilities. | Peng Xu, Wei Ping, Xianchao Wu, Chejian Xu, Zihan Liu, Mohammad Shoeybi, Bryan Catanzaro |
| 2024 | CVPR | VILA: On Pre-training for Visual Language Models. | Ji Lin, Hongxu Yin, Wei Ping, Pavlo Molchanov, Mohammad Shoeybi, Song Han |
| 2024 | EMNLP | Data, Data Everywhere: A Guide for Pretraining Dataset Construction. | Jupinder Parmar, Shrimai Prabhumoye, Joseph Jennings, Bo Liu, Aastha Jhunjhunwala, Zhilin Wang, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro |
| 2024 | EMNLP | LLM-Evolve: Evaluation for LLM's Evolving Capability on Benchmarks. | Jiaxuan You, Mingjie Liu, Shrimai Prabhumoye, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro |
| 2024 | ICLR | Retrieval meets Long Context Large Language Models. | Peng Xu, Wei Ping, Xianchao Wu, Lawrence McAfee, Chen Zhu, Zihan Liu, Sandeep Subramanian, Evelina Bakhturina, Mohammad Shoeybi, Bryan Catanzaro |
| 2024 | ICML | ODIN: Disentangled Reward Mitigates Hacking in RLHF. | Lichang Chen, Chen Zhu, Jiuhai Chen, Davit Soselia, Tianyi Zhou, Tom Goldstein, Heng Huang, Mohammad Shoeybi, Bryan Catanzaro |
| 2024 | ICML | InstructRetro: Instruction Tuning post Retrieval-Augmented Pretraining. | Boxin Wang, Wei Ping, Lawrence McAfee, Peng Xu, Bo Li, Mohammad Shoeybi, Bryan Catanzaro |
| 2023 | EACL | Adding Instructions during Pretraining: Effective way of Controlling Toxicity in Language Models. | Shrimai Prabhumoye, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro |
| 2023 | EACL | Context Generation Improves Open Domain Question Answering. | Dan Su, Mostofa Patwary, Shrimai Prabhumoye, Peng Xu, Ryan Prenger, Mohammad Shoeybi, Pascale Fung, Anima Anandkumar, Bryan Catanzaro |
| 2023 | EMNLP | Shall We Pretrain Autoregressive Language Models with Retrieval? A Comprehensive Study. | Boxin Wang, Wei Ping, Peng Xu, Lawrence McAfee, Zihan Liu, Mohammad Shoeybi, Yi Dong, Oleksii Kuchaiev, Bo Li, Chaowei Xiao, Anima Anandkumar, Bryan Catanzaro |
| 2023 | EMNLP | Re-ViLM: Retrieval-Augmented Visual Language Model for Zero and Few-Shot Image Captioning. | Zhuolin Yang, Wei Ping, Zihan Liu, Vijay Korthikanti, Weili Nie, De-An Huang, Linxi Fan, Zhiding Yu, Shiyi Lan, Bo Li, Mohammad Shoeybi, Ming-Yu Liu, Yuke Zhu, Bryan Catanzaro, Chaowei Xiao, Anima Anandkumar |
| 2022 | ACL | Multi-Stage Prompting for Knowledgeable Dialogue Generation. | Zihan Liu, Mostofa Patwary, Ryan Prenger, Shrimai Prabhumoye, Wei Ping, Mohammad Shoeybi, Bryan Catanzaro |
| 2022 | EMNLP | Evaluating Parameter Efficient Learning for Generation. | Peng Xu, Mostofa Patwary, Shrimai Prabhumoye, Virginia Adams, Ryan Prenger, Wei Ping, Nayeon Lee, Mohammad Shoeybi, Bryan Catanzaro |
| 2022 | EMNLP | Prompt Compression and Contrastive Conditioning for Controllability and Toxicity Reduction in Language Models. | David Wingate, Mohammad Shoeybi, Taylor Sorensen |
| 2021 | ACL | End-to-End Training of Neural Retrievers for Open-Domain Question Answering. | Devendra Singh Sachan, Mostofa Patwary, Mohammad Shoeybi, Neel Kant, Wei Ping, William L. Hamilton, Bryan Catanzaro |
| 2021 | SC | Efficient large-scale language model training on GPU clusters using megatron-LM. | Deepak Narayanan, Mohammad Shoeybi, Jared Casper, Patrick LeGresley, Mostofa Patwary, Vijay Korthikanti, Dmitri Vainbrand, Prethvi Kashinkunti, Julie Bernauer, Bryan Catanzaro, Amar Phanishayee, Matei Zaharia |
| 2020 | ACL | Large Scale Multi-Actor Generative Dialog Modeling. | Alex Boyd, Raul Puri, Mohammad Shoeybi, Mostofa Patwary, Bryan Catanzaro |
| 2020 | EMNLP | Training Question Answering Models From Synthetic Data. | Raul Puri, Ryan Spring, Mohammad Shoeybi, Mostofa Patwary, Bryan Catanzaro |
| 2020 | EMNLP | BioMegatron: Larger Biomedical Domain Language Model. | Hoo-Chang Shin, Yang Zhang, Evelina Bakhturina, Raul Puri, Mostofa Patwary, Mohammad Shoeybi, Raghav Mani |
| 2020 | EMNLP | MEGATRON-CNTRL: Controllable Story Generation with External Knowledge Using Large-Scale Language Models. | Peng Xu, Mostofa Patwary, Mohammad Shoeybi, Raul Puri, Pascale Fung, Anima Anandkumar, Bryan Catanzaro |
| 2019 | ICCV | Unsupervised Video Interpolation Using Cycle Consistency. | Fitsum A. Reda, Deqing Sun, Aysegul Dundar, Mohammad Shoeybi, Guilin Liu, Kevin J. Shih, Andrew Tao, Jan Kautz, Bryan Catanzaro |
| 2017 | ICML | Deep Voice: Real-time Neural Text-to-Speech. | Sercan mer Arik, Mike Chrzanowski, Adam Coates, Gregory Frederick Diamos, Andrew Gibiansky, Yongguo Kang, Xian Li, John Miller, Andrew Y. Ng, Jonathan Raiman, Shubho Sengupta, Mohammad Shoeybi |