Skip to content

Mostofa Patwary

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

16

Venues

5

Active years

2019–2026

Best venue rank

A*

Where they publish

Papers

16 indexed papers, newest first.

YearVenueTitleAuthors
2026EACLNemotron-CrossThink: Scaling Self-Learning beyond Math Reasoning.Syeda Nahida Akter, Shrimai Prabhumoye, Matvei Novikov, Seungju Han, Ying Lin, Evelina Bakhturina, Eric Nyberg, Yejin Choi, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro
2025ACLNemotron-CC: Transforming Common Crawl into a Refined Long-Horizon Pretraining Dataset.Dan Su, Kezhi Kong, Ying Lin, Joseph Jennings, Brandon Norick, Markus Kliegl, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro
2025ICLRMIND: Math Informed syNthetic Dialogues for Pretraining LLMs.Syeda Nahida Akter, Shrimai Prabhumoye, John Kamalu, Sanjeev Satheesh, Eric Nyberg, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro
2024EMNLPData, Data Everywhere: A Guide for Pretraining Dataset Construction.Jupinder Parmar, Shrimai Prabhumoye, Joseph Jennings, Bo Liu, Aastha Jhunjhunwala, Zhilin Wang, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro
2024EMNLPLLM-Evolve: Evaluation for LLM's Evolving Capability on Benchmarks.Jiaxuan You, Mingjie Liu, Shrimai Prabhumoye, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro
2023EACLAdding Instructions during Pretraining: Effective way of Controlling Toxicity in Language Models.Shrimai Prabhumoye, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro
2023EACLContext Generation Improves Open Domain Question Answering.Dan Su, Mostofa Patwary, Shrimai Prabhumoye, Peng Xu, Ryan Prenger, Mohammad Shoeybi, Pascale Fung, Anima Anandkumar, Bryan Catanzaro
2022ACLMulti-Stage Prompting for Knowledgeable Dialogue Generation.Zihan Liu, Mostofa Patwary, Ryan Prenger, Shrimai Prabhumoye, Wei Ping, Mohammad Shoeybi, Bryan Catanzaro
2022EMNLPEvaluating Parameter Efficient Learning for Generation.Peng Xu, Mostofa Patwary, Shrimai Prabhumoye, Virginia Adams, Ryan Prenger, Wei Ping, Nayeon Lee, Mohammad Shoeybi, Bryan Catanzaro
2021ACLEnd-to-End Training of Neural Retrievers for Open-Domain Question Answering.Devendra Singh Sachan, Mostofa Patwary, Mohammad Shoeybi, Neel Kant, Wei Ping, William L. Hamilton, Bryan Catanzaro
2021SCEfficient large-scale language model training on GPU clusters using megatron-LM.Deepak Narayanan, Mohammad Shoeybi, Jared Casper, Patrick LeGresley, Mostofa Patwary, Vijay Korthikanti, Dmitri Vainbrand, Prethvi Kashinkunti, Julie Bernauer, Bryan Catanzaro, Amar Phanishayee, Matei Zaharia
2020ACLLarge Scale Multi-Actor Generative Dialog Modeling.Alex Boyd, Raul Puri, Mohammad Shoeybi, Mostofa Patwary, Bryan Catanzaro
2020EMNLPTraining Question Answering Models From Synthetic Data.Raul Puri, Ryan Spring, Mohammad Shoeybi, Mostofa Patwary, Bryan Catanzaro
2020EMNLPBioMegatron: Larger Biomedical Domain Language Model.Hoo-Chang Shin, Yang Zhang, Evelina Bakhturina, Raul Puri, Mostofa Patwary, Mohammad Shoeybi, Raghav Mani
2020EMNLPMEGATRON-CNTRL: Controllable Story Generation with External Knowledge Using Large-Scale Language Models.Peng Xu, Mostofa Patwary, Mohammad Shoeybi, Raul Puri, Pascale Fung, Anima Anandkumar, Bryan Catanzaro
2019SCDisCo: Physics-Based Unsupervised Discovery of Coherent Structures in Spatiotemporal Systems.Adam Rupe, Prabhat, James P. Crutchfield, Nalini Kumar, Vladislav Epifanov, Karthik Kashinath, Oleksandr Pavlyk, Frank Schlimbach, Mostofa Patwary, Sergey Maidanov, Victor W. Lee