Skip to content

Ben Bogin

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

16

Venues

5

Active years

2018–2025

Best venue rank

A*

Where they publish

Papers

16 indexed papers, newest first.

YearVenueTitleAuthors
2025COLINGAurora-M: Open Source Continual Pre-training for Multilingual Language and Code.Taishi Nakamura, Mayank Mishra, Simone Tedeschi, Yekun Chai, Jason T. Stillerman, Felix Friedrich, Prateek Yadav, Tanmay Laud, Minh Chien Vu, Terry Yue Zhuo, Diganta Misra, Ben Bogin, Xuan-Son Vu, Marzena Karpinska, Arnav Varma Dantuluri, Wojciech Kusa, Tommaso Furlanello, Rio Yokota, Niklas Muennighoff, Suhas Pai, Tosin P. Adewumi, Veronika Laippala, Xiaozhe Yao, Adalberto Barbosa Junior, Aleksandr Drozd, Jordan Clive, Kshitij Gupta, Liangyu Chen, Qi Sun, Ken Tsui, Nour Moustafa-Fahmy, Nicolo Monti, Tai Dang, Ziyang Luo, Tien-Tung Bui, Roberto Navigli, Virendra Mehta, Matthew Blumberg, Victor May, Hiep Nguyen, Sampo Pyysalo
2025ICMLDataDecide: How to Predict Best Pretraining Data with Small Experiments.Ian Magnusson, Nguyen Tai, Ben Bogin, David Heineman, Jena D. Hwang, Luca Soldaini, Akshita Bhagia, Jiacheng Liu, Dirk Groeneveld, Oyvind Tafjord, Noah A. Smith, Pang Wei Koh, Jesse Dodge
2024ACLDolma: an Open Corpus of Three Trillion Tokens for Language Model Pretraining Research.Luca Soldaini, Rodney Kinney, Akshita Bhagia, Dustin Schwenk, David Atkinson, Russell Authur, Ben Bogin, Khyathi Raghavi Chandu, Jennifer Dumas, Yanai Elazar, Valentin Hofmann, Ananya Harsh Jha, Sachin Kumar, Li Lucy, Xinxi Lyu, Nathan Lambert, Ian Magnusson, Jacob Morrison, Niklas Muennighoff, Aakanksha Naik, Crystal Nam, Matthew E. Peters, Abhilasha Ravichander, Kyle Richardson, Zejiang Shen, Emma Strubell, Nishant Subramani, Oyvind Tafjord, Pete Walsh, Luke Zettlemoyer, Noah A. Smith, Hannaneh Hajishirzi, Iz Beltagy, Dirk Groeneveld, Jesse Dodge, Kyle Lo
2024EMNLPSUPER: Evaluating Agents on Setting Up and Executing Tasks from Research Repositories.Ben Bogin, Kejuan Yang, Shashank Gupta, Kyle Richardson, Erin Bransom, Peter Clark, Ashish Sabharwal, Tushar Khot
2024EMNLPAssistantBench: Can Web Agents Solve Realistic and Time-Consuming Tasks?Ori Yoran, Samuel Joseph Amouyal, Chaitanya Malaviya, Ben Bogin, Ofir Press, Jonathan Berant
2024NAACLLeveraging Code to Improve In-Context Learning for Semantic Parsing.Ben Bogin, Shivanshu Gupta, Peter Clark, Ashish Sabharwal
2023ACLDiverse Demonstrations Improve In-context Compositional Generalization.Itay Levy, Ben Bogin, Jonathan Berant
2023EMNLPAnswering Questions by Meta-Reasoning over Multiple Chains of Thought.Ori Yoran, Tomer Wolfson, Ben Bogin, Uri Katz, Daniel Deutch, Jonathan Berant
2022EMNLPUnobserved Local Structures Make Compositional Generalization Hard.Ben Bogin, Shivanshu Gupta, Jonathan Berant
2021EMNLPCOVR: A Test-Bed for Visually Grounded Compositional Generalization with Real Images.Ben Bogin, Shivanshu Gupta, Matt Gardner, Jonathan Berant
2020ACLObtaining Faithful Interpretations from Compositional Neural Networks.Sanjay Subramanian, Ben Bogin, Nitish Gupta, Tomer Wolfson, Sameer Singh, Jonathan Berant, Matt Gardner
2020EMNLPEvaluating Models' Local Decision Boundaries via Contrast Sets.Matt Gardner, Yoav Artzi, Victoria Basmova, Jonathan Berant, Ben Bogin, Sihao Chen, Pradeep Dasigi, Dheeru Dua, Yanai Elazar, Ananth Gottumukkala, Nitish Gupta, Hannaneh Hajishirzi, Gabriel Ilharco, Daniel Khashabi, Kevin Lin, Jiangming Liu, Nelson F. Liu, Phoebe Mulcaire, Qiang Ning, Sameer Singh, Noah A. Smith, Sanjay Subramanian, Reut Tsarfaty, Eric Wallace, Ally Zhang, Ben Zhou
2020EMNLPMedICaT: A Dataset of Medical Images, Captions, and Textual References.Sanjay Subramanian, Lucy Lu Wang, Ben Bogin, Sachin Mehta, Madeleine van Zuylen, Sravanthi Parasa, Sameer Singh, Matt Gardner, Hannaneh Hajishirzi
2019ACLRepresenting Schema Structure with Graph Neural Networks for Text-to-SQL Parsing.Ben Bogin, Jonathan Berant, Matt Gardner
2019EMNLPGlobal Reasoning over Database Structures for Text-to-SQL Parsing.Ben Bogin, Matt Gardner, Jonathan Berant
2018COLINGTowards an argumentative content search engine using weak supervision.Ran Levy, Ben Bogin, Shai Gretz, Ranit Aharonov, Noam Slonim