Jesse Dodge
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
30
Venues
7
Active years
2012–2025
Best venue rank
A*
Where they publish
Papers
30 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ACL | OLMoTrace: Tracing Language Model Outputs Back to Trillions of Training Tokens. | Jiacheng Liu, Taylor Blanton, Yanai Elazar, Sewon Min, Yen-Sung Chen, Arnavi Chheda-Kothary, Huy Tran, Byron Bischoff, Eric Marsh, Michael Schmitz, Cassidy Trier, Aaron Sarnat, Jenna James, Jon Borchardt, Bailey Kuehl, Evie Yu-Yen Cheng, Karen Farley, Taira Anderson, David Albright, Carissa Schoenick, Luca Soldaini, Dirk Groeneveld, Rock Yuren Pang, Pang Wei Koh, Noah A. Smith, Sophie Lebrecht, Yejin Choi, Hannaneh Hajishirzi, Ali Farhadi, Jesse Dodge |
| 2025 | ICLR | Holistically Evaluating the Environmental Impact of Creating Language Models. | Jacob Morrison, Clara Na, Jared Fernandez, Tim Dettmers, Emma Strubell, Jesse Dodge |
| 2025 | ICML | DataDecide: How to Predict Best Pretraining Data with Small Experiments. | Ian Magnusson, Nguyen Tai, Ben Bogin, David Heineman, Jena D. Hwang, Luca Soldaini, Akshita Bhagia, Jiacheng Liu, Dirk Groeneveld, Oyvind Tafjord, Noah A. Smith, Pang Wei Koh, Jesse Dodge |
| 2025 | NAACL | OLMES: A Standard for Language Model Evaluations. | Yuling Gu, Oyvind Tafjord, Bailey Kuehl, Dany Haddad, Jesse Dodge, Hannaneh Hajishirzi |
| 2024 | ACL | OLMo: Accelerating the Science of Language Models. | Dirk Groeneveld, Iz Beltagy, Evan Pete Walsh, Akshita Bhagia, Rodney Kinney, Oyvind Tafjord, Ananya Harsh Jha, Hamish Ivison, Ian Magnusson, Yizhong Wang, Shane Arora, David Atkinson, Russell Authur, Khyathi Raghavi Chandu, Arman Cohan, Jennifer Dumas, Yanai Elazar, Yuling Gu, Jack Hessel, Tushar Khot, William Merrill, Jacob Morrison, Niklas Muennighoff, Aakanksha Naik, Crystal Nam, Matthew E. Peters, Valentina Pyatkin, Abhilasha Ravichander, Dustin Schwenk, Saurabh Shah, Will Smith, Emma Strubell, Nishant Subramani, Mitchell Wortsman, Pradeep Dasigi, Nathan Lambert, Kyle Richardson, Luke Zettlemoyer, Jesse Dodge, Kyle Lo, Luca Soldaini, Noah A. Smith, Hannaneh Hajishirzi |
| 2024 | ACL | AboutMe: Using Self-Descriptions in Webpages to Document the Effects of English Pretraining Data Filters. | Li Lucy, Suchin Gururangan, Luca Soldaini, Emma Strubell, David Bamman, Lauren F. Klein, Jesse Dodge |
| 2024 | ACL | Dolma: an Open Corpus of Three Trillion Tokens for Language Model Pretraining Research. | Luca Soldaini, Rodney Kinney, Akshita Bhagia, Dustin Schwenk, David Atkinson, Russell Authur, Ben Bogin, Khyathi Raghavi Chandu, Jennifer Dumas, Yanai Elazar, Valentin Hofmann, Ananya Harsh Jha, Sachin Kumar, Li Lucy, Xinxi Lyu, Nathan Lambert, Ian Magnusson, Jacob Morrison, Niklas Muennighoff, Aakanksha Naik, Crystal Nam, Matthew E. Peters, Abhilasha Ravichander, Kyle Richardson, Zejiang Shen, Emma Strubell, Nishant Subramani, Oyvind Tafjord, Pete Walsh, Luke Zettlemoyer, Noah A. Smith, Hannaneh Hajishirzi, Iz Beltagy, Dirk Groeneveld, Jesse Dodge, Kyle Lo |
| 2024 | EMNLP | Merge to Learn: Efficiently Adding Skills to Language Models with Model Merging. | Jacob Morrison, Noah A. Smith, Hannaneh Hajishirzi, Pang Wei Koh, Jesse Dodge, Pradeep Dasigi |
| 2024 | EMNLP | Scalable Data Ablation Approximations for Language Models through Modular Training and Merging. | Clara Na, Ian Magnusson, Ananya Harsh Jha, Tom Sherborne, Emma Strubell, Jesse Dodge, Pradeep Dasigi |
| 2024 | ICLR | What's In My Big Data? | Yanai Elazar, Akshita Bhagia, Ian Magnusson, Abhilasha Ravichander, Dustin Schwenk, Alane Suhr, Evan Pete Walsh, Dirk Groeneveld, Luca Soldaini, Sameer Singh, Hannaneh Hajishirzi, Noah A. Smith, Jesse Dodge |
| 2024 | NAACL | Language Models Hallucinate, but May Excel at Fact Verification. | Jian Guan, Jesse Dodge, David Wadden, Minlie Huang, Hao Peng |
| 2023 | ACL | Words as Gatekeepers: Measuring Discipline-specific Terms and Meanings in Scholarly Publications. | Li Lucy, Jesse Dodge, David Bamman, Katherine A. Keith |
| 2023 | ACL | Reproducibility in NLP: What Have We Learned from the Checklist? | Ian Magnusson, Noah A. Smith, Jesse Dodge |
| 2023 | ACL | Stubborn Lexical Bias in Data and Models. | Sofia Serrano, Jesse Dodge, Noah A. Smith |
| 2023 | EACL | AdapterSoup: Weight Averaging to Improve Generalization of Pretrained Language Models. | Alexandra Chronopoulou, Matthew E. Peters, Alexander Fraser, Jesse Dodge |
| 2022 | ACL | Towards Reproducible Machine Learning Research in Natural Language Processing. | Ana Lucic, Maurits J. R. Bleeker, Samarth Bhargav, Jessica Zosa Forde, Koustuv Sinha, Jesse Dodge, Sasha Luccioni, Robert Stojnic |
| 2022 | ICML | Staged Training for Transformer Language Models. | Sheng Shen, Pete Walsh, Kurt Keutzer, Jesse Dodge, Matthew E. Peters, Iz Beltagy |
| 2022 | NAACL | Efficient Hierarchical Domain Adaptation for Pretrained Language Models. | Alexandra Chronopoulou, Matthew E. Peters, Jesse Dodge |
| 2021 | EMNLP | Competency Problems: On Finding and Removing Artifacts in Language Data. | Matt Gardner, William Merrill, Jesse Dodge, Matthew E. Peters, Alexis Ross, Sameer Singh, Noah A. Smith |
| 2021 | EMNLP | Expected Validation Performance and Estimation of a Random Variable's Maximum. | Jesse Dodge, Suchin Gururangan, Dallas Card, Roy Schwartz, Noah A. Smith |
| 2021 | EMNLP | Documenting Large Webtext Corpora: A Case Study on the Colossal Clean Crawled Corpus. | Jesse Dodge, Maarten Sap, Ana Marasovic, William Agnew, Gabriel Ilharco, Dirk Groeneveld, Margaret Mitchell, Matt Gardner |
| 2020 | ACL | The Right Tool for the Job: Matching Model and Instance Complexities. | Roy Schwartz, Gabriel Stanovsky, Swabha Swayamdipta, Jesse Dodge, Noah A. Smith |
| 2019 | EMNLP | Show Your Work: Improved Reporting of Experimental Results. | Jesse Dodge, Suchin Gururangan, Dallas Card, Roy Schwartz, Noah A. Smith |
| 2019 | EMNLP | RNN Architecture Learning with Sparse Regularization. | Jesse Dodge, Roy Schwartz, Hao Peng, Noah A. Smith |
| 2016 | EMNLP | Key-Value Memory Networks for Directly Reading Documents. | Alexander H. Miller, Adam Fisch, Jesse Dodge, Amir-Hossein Karimi, Antoine Bordes, Jason Weston |
| 2015 | NAACL | Retrofitting Word Vectors to Semantic Lexicons. | Manaal Faruqui, Jesse Dodge, Sujay Kumar Jauhar, Chris Dyer, Eduard H. Hovy, Noah A. Smith |
| 2014 | ACL | Context-dependent Semantic Parsing for Time Expressions. | Kenton Lee, Yoav Artzi, Jesse Dodge, Luke Zettlemoyer |
| 2012 | CVPR | Understanding and predicting importance in images. | Alexander C. Berg, Tamara L. Berg, Hal Daum III, Jesse Dodge, Amit Goyal, Xufeng Han, Alyssa C. Mensch, Margaret Mitchell, Aneesh Sood, Karl Stratos, Kota Yamaguchi |
| 2012 | EACL | Midge: Generating Image Descriptions From Computer Vision Detections. | Margaret Mitchell, Jesse Dodge, Amit Goyal, Kota Yamaguchi, Karl Stratos, Xufeng Han, Alyssa C. Mensch, Alexander C. Berg, Tamara L. Berg, Hal Daum III |
| 2012 | NAACL | Detecting Visual Text. | Jesse Dodge, Amit Goyal, Xufeng Han, Alyssa C. Mensch, Margaret Mitchell, Karl Stratos, Kota Yamaguchi, Yejin Choi, Hal Daum III, Alexander C. Berg, Tamara L. Berg |