Skip to content

Suchin Gururangan

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

21

Venues

5

Active years

2018–2025

Best venue rank

A*

Where they publish

Papers

21 indexed papers, newest first.

YearVenueTitleAuthors
2025EMNLPBTS: Harmonizing Specialized Experts into a Generalist LLM.Qizhen Zhang, Prajjwal Bhargava, Chloe Bi, Chris X. Cai, Jakob Nicolaus Foerster, Jeremy Fu, Punit Singh Koura, Ruan Silva, Sheng Shen, Emily Dinan, Suchin Gururangan, Mike Lewis
2025ICLRLanguage models scale reliably with over-training and on downstream tasks.Samir Yitzhak Gadre, Georgios Smyrnis, Vaishaal Shankar, Suchin Gururangan, Mitchell Wortsman, Rulin Shao, Jean Mercat, Alex Fang, Jeffrey Li, Sedrick Keh, Rui Xin, Marianna Nezhurina, Igor Vasiljevic, Luca Soldaini, Jenia Jitsev, Alex Dimakis, Gabriel Ilharco, Pang Wei Koh, Shuran Song, Thomas Kollar, et al.
2025NAACLSelf-Generated Critiques Boost Reward Modeling for Language Models.Yue Yu, Zhengxing Chen, Aston Zhang, Liang Tan, Chenguang Zhu, Richard Yuanzhe Pang, Yundi Qian, Xuewei Wang, Suchin Gururangan, Chao Zhang, Melanie Kambadur, Dhruv Mahajan, Rui Hou
2024ACLAboutMe: Using Self-Descriptions in Webpages to Document the Effects of English Pretraining Data Filters.Li Lucy, Suchin Gururangan, Luca Soldaini, Emma Strubell, David Bamman, Lauren F. Klein, Jesse Dodge
2024ACLTime is Encoded in the Weights of Finetuned Language Models.Kai Nylund, Suchin Gururangan, Noah A. Smith
2024EMNLPBreaking the Curse of Multilinguality with Cross-lingual Expert Language Models.Terra Blevins, Tomasz Limisiewicz, Suchin Gururangan, Margaret Li, Hila Gonen, Noah A. Smith, Luke Zettlemoyer
2024ICLRSILO Language Models: Isolating Legal Risk In a Nonparametric Datastore.Sewon Min, Suchin Gururangan, Eric Wallace, Weijia Shi, Hannaneh Hajishirzi, Noah A. Smith, Luke Zettlemoyer
2024ICMLLESS: Selecting Influential Data for Targeted Instruction Tuning.Mengzhou Xia, Sadhika Malladi, Suchin Gururangan, Sanjeev Arora, Danqi Chen
2022EMNLPWhose Language Counts as High Quality? Measuring Language Ideologies in Text Data Selection.Suchin Gururangan, Dallas Card, Sarah K. Dreier, Emily K. Gade, Leroy Z. Wang, Zeyu Wang, Luke Zettlemoyer, Noah A. Smith
2022EMNLPM2D2: A Massively Multi-Domain Language Modeling Dataset.Machel Reid, Victor Zhong, Suchin Gururangan, Luke Zettlemoyer
2022EMNLPNearest Neighbor Zero-Shot Inference.Weijia Shi, Julian Michael, Suchin Gururangan, Luke Zettlemoyer
2022NAACLDEMix Layers: Disentangling Domains for Modular Language Modeling.Suchin Gururangan, Mike Lewis, Ari Holtzman, Noah A. Smith, Luke Zettlemoyer
2022NAACLTime Waits for No One! Analysis and Challenges of Temporal Misalignment.Kelvin Luu, Daniel Khashabi, Suchin Gururangan, Karishma Mandyam, Noah A. Smith
2021ACLAll That's 'Human' Is Not Gold: Evaluating Human Evaluation of Generated Text.Elizabeth Clark, Tal August, Sofia Serrano, Nikita Haduong, Suchin Gururangan, Noah A. Smith
2021EMNLPExpected Validation Performance and Estimation of a Random Variable's Maximum.Jesse Dodge, Suchin Gururangan, Dallas Card, Roy Schwartz, Noah A. Smith
2021NAACLDetoxifying Language Models Risks Marginalizing Minority Voices.Albert Xu, Eshaan Pathak, Eric Wallace, Suchin Gururangan, Maarten Sap, Dan Klein
2020ACLDon't Stop Pretraining: Adapt Language Models to Domains and Tasks.Suchin Gururangan, Ana Marasovic, Swabha Swayamdipta, Kyle Lo, Iz Beltagy, Doug Downey, Noah A. Smith
2020EMNLPRealToxicityPrompts: Evaluating Neural Toxic Degeneration in Language Models.Samuel Gehman, Suchin Gururangan, Maarten Sap, Yejin Choi, Noah A. Smith
2019ACLVariational Pretraining for Semi-supervised Text Classification.Suchin Gururangan, Tam Dang, Dallas Card, Noah A. Smith
2019EMNLPShow Your Work: Improved Reporting of Experimental Results.Jesse Dodge, Suchin Gururangan, Dallas Card, Roy Schwartz, Noah A. Smith
2018NAACLAnnotation Artifacts in Natural Language Inference Data.Suchin Gururangan, Swabha Swayamdipta, Omer Levy, Roy Schwartz, Samuel R. Bowman, Noah A. Smith