Skip to content

Jesse Dodge

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

30

Venues

7

Active years

2012–2025

Best venue rank

A*

Where they publish

Papers

30 indexed papers, newest first.

YearVenueTitleAuthors
2025ACLOLMoTrace: Tracing Language Model Outputs Back to Trillions of Training Tokens.Jiacheng Liu, Taylor Blanton, Yanai Elazar, Sewon Min, Yen-Sung Chen, Arnavi Chheda-Kothary, Huy Tran, Byron Bischoff, Eric Marsh, Michael Schmitz, Cassidy Trier, Aaron Sarnat, Jenna James, Jon Borchardt, Bailey Kuehl, Evie Yu-Yen Cheng, Karen Farley, Taira Anderson, David Albright, Carissa Schoenick, Luca Soldaini, Dirk Groeneveld, Rock Yuren Pang, Pang Wei Koh, Noah A. Smith, Sophie Lebrecht, Yejin Choi, Hannaneh Hajishirzi, Ali Farhadi, Jesse Dodge
2025ICLRHolistically Evaluating the Environmental Impact of Creating Language Models.Jacob Morrison, Clara Na, Jared Fernandez, Tim Dettmers, Emma Strubell, Jesse Dodge
2025ICMLDataDecide: How to Predict Best Pretraining Data with Small Experiments.Ian Magnusson, Nguyen Tai, Ben Bogin, David Heineman, Jena D. Hwang, Luca Soldaini, Akshita Bhagia, Jiacheng Liu, Dirk Groeneveld, Oyvind Tafjord, Noah A. Smith, Pang Wei Koh, Jesse Dodge
2025NAACLOLMES: A Standard for Language Model Evaluations.Yuling Gu, Oyvind Tafjord, Bailey Kuehl, Dany Haddad, Jesse Dodge, Hannaneh Hajishirzi
2024ACLOLMo: Accelerating the Science of Language Models.Dirk Groeneveld, Iz Beltagy, Evan Pete Walsh, Akshita Bhagia, Rodney Kinney, Oyvind Tafjord, Ananya Harsh Jha, Hamish Ivison, Ian Magnusson, Yizhong Wang, Shane Arora, David Atkinson, Russell Authur, Khyathi Raghavi Chandu, Arman Cohan, Jennifer Dumas, Yanai Elazar, Yuling Gu, Jack Hessel, Tushar Khot, William Merrill, Jacob Morrison, Niklas Muennighoff, Aakanksha Naik, Crystal Nam, Matthew E. Peters, Valentina Pyatkin, Abhilasha Ravichander, Dustin Schwenk, Saurabh Shah, Will Smith, Emma Strubell, Nishant Subramani, Mitchell Wortsman, Pradeep Dasigi, Nathan Lambert, Kyle Richardson, Luke Zettlemoyer, Jesse Dodge, Kyle Lo, Luca Soldaini, Noah A. Smith, Hannaneh Hajishirzi
2024ACLAboutMe: Using Self-Descriptions in Webpages to Document the Effects of English Pretraining Data Filters.Li Lucy, Suchin Gururangan, Luca Soldaini, Emma Strubell, David Bamman, Lauren F. Klein, Jesse Dodge
2024ACLDolma: an Open Corpus of Three Trillion Tokens for Language Model Pretraining Research.Luca Soldaini, Rodney Kinney, Akshita Bhagia, Dustin Schwenk, David Atkinson, Russell Authur, Ben Bogin, Khyathi Raghavi Chandu, Jennifer Dumas, Yanai Elazar, Valentin Hofmann, Ananya Harsh Jha, Sachin Kumar, Li Lucy, Xinxi Lyu, Nathan Lambert, Ian Magnusson, Jacob Morrison, Niklas Muennighoff, Aakanksha Naik, Crystal Nam, Matthew E. Peters, Abhilasha Ravichander, Kyle Richardson, Zejiang Shen, Emma Strubell, Nishant Subramani, Oyvind Tafjord, Pete Walsh, Luke Zettlemoyer, Noah A. Smith, Hannaneh Hajishirzi, Iz Beltagy, Dirk Groeneveld, Jesse Dodge, Kyle Lo
2024EMNLPMerge to Learn: Efficiently Adding Skills to Language Models with Model Merging.Jacob Morrison, Noah A. Smith, Hannaneh Hajishirzi, Pang Wei Koh, Jesse Dodge, Pradeep Dasigi
2024EMNLPScalable Data Ablation Approximations for Language Models through Modular Training and Merging.Clara Na, Ian Magnusson, Ananya Harsh Jha, Tom Sherborne, Emma Strubell, Jesse Dodge, Pradeep Dasigi
2024ICLRWhat's In My Big Data?Yanai Elazar, Akshita Bhagia, Ian Magnusson, Abhilasha Ravichander, Dustin Schwenk, Alane Suhr, Evan Pete Walsh, Dirk Groeneveld, Luca Soldaini, Sameer Singh, Hannaneh Hajishirzi, Noah A. Smith, Jesse Dodge
2024NAACLLanguage Models Hallucinate, but May Excel at Fact Verification.Jian Guan, Jesse Dodge, David Wadden, Minlie Huang, Hao Peng
2023ACLWords as Gatekeepers: Measuring Discipline-specific Terms and Meanings in Scholarly Publications.Li Lucy, Jesse Dodge, David Bamman, Katherine A. Keith
2023ACLReproducibility in NLP: What Have We Learned from the Checklist?Ian Magnusson, Noah A. Smith, Jesse Dodge
2023ACLStubborn Lexical Bias in Data and Models.Sofia Serrano, Jesse Dodge, Noah A. Smith
2023EACLAdapterSoup: Weight Averaging to Improve Generalization of Pretrained Language Models.Alexandra Chronopoulou, Matthew E. Peters, Alexander Fraser, Jesse Dodge
2022ACLTowards Reproducible Machine Learning Research in Natural Language Processing.Ana Lucic, Maurits J. R. Bleeker, Samarth Bhargav, Jessica Zosa Forde, Koustuv Sinha, Jesse Dodge, Sasha Luccioni, Robert Stojnic
2022ICMLStaged Training for Transformer Language Models.Sheng Shen, Pete Walsh, Kurt Keutzer, Jesse Dodge, Matthew E. Peters, Iz Beltagy
2022NAACLEfficient Hierarchical Domain Adaptation for Pretrained Language Models.Alexandra Chronopoulou, Matthew E. Peters, Jesse Dodge
2021EMNLPCompetency Problems: On Finding and Removing Artifacts in Language Data.Matt Gardner, William Merrill, Jesse Dodge, Matthew E. Peters, Alexis Ross, Sameer Singh, Noah A. Smith
2021EMNLPExpected Validation Performance and Estimation of a Random Variable's Maximum.Jesse Dodge, Suchin Gururangan, Dallas Card, Roy Schwartz, Noah A. Smith
2021EMNLPDocumenting Large Webtext Corpora: A Case Study on the Colossal Clean Crawled Corpus.Jesse Dodge, Maarten Sap, Ana Marasovic, William Agnew, Gabriel Ilharco, Dirk Groeneveld, Margaret Mitchell, Matt Gardner
2020ACLThe Right Tool for the Job: Matching Model and Instance Complexities.Roy Schwartz, Gabriel Stanovsky, Swabha Swayamdipta, Jesse Dodge, Noah A. Smith
2019EMNLPShow Your Work: Improved Reporting of Experimental Results.Jesse Dodge, Suchin Gururangan, Dallas Card, Roy Schwartz, Noah A. Smith
2019EMNLPRNN Architecture Learning with Sparse Regularization.Jesse Dodge, Roy Schwartz, Hao Peng, Noah A. Smith
2016EMNLPKey-Value Memory Networks for Directly Reading Documents.Alexander H. Miller, Adam Fisch, Jesse Dodge, Amir-Hossein Karimi, Antoine Bordes, Jason Weston
2015NAACLRetrofitting Word Vectors to Semantic Lexicons.Manaal Faruqui, Jesse Dodge, Sujay Kumar Jauhar, Chris Dyer, Eduard H. Hovy, Noah A. Smith
2014ACLContext-dependent Semantic Parsing for Time Expressions.Kenton Lee, Yoav Artzi, Jesse Dodge, Luke Zettlemoyer
2012CVPRUnderstanding and predicting importance in images.Alexander C. Berg, Tamara L. Berg, Hal Daum III, Jesse Dodge, Amit Goyal, Xufeng Han, Alyssa C. Mensch, Margaret Mitchell, Aneesh Sood, Karl Stratos, Kota Yamaguchi
2012EACLMidge: Generating Image Descriptions From Computer Vision Detections.Margaret Mitchell, Jesse Dodge, Amit Goyal, Kota Yamaguchi, Karl Stratos, Xufeng Han, Alyssa C. Mensch, Alexander C. Berg, Tamara L. Berg, Hal Daum III
2012NAACLDetecting Visual Text.Jesse Dodge, Amit Goyal, Xufeng Han, Alyssa C. Mensch, Margaret Mitchell, Karl Stratos, Kota Yamaguchi, Yejin Choi, Hal Daum III, Alexander C. Berg, Tamara L. Berg