Skip to content

Samuel R. Bowman

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

61

Venues

12

Active years

2010–2025

Best venue rank

A*

Where they publish

Papers

61 indexed papers, newest first.

YearVenueTitleAuthors
2025ICLRLanguage Models Learn to Mislead Humans via RLHF.Jiaxin Wen, Ruiqi Zhong, Akbir Khan, Ethan Perez, Jacob Steinhardt, Minlie Huang, Samuel R. Bowman, He He, Shi Feng
2024ICLRTowards Understanding Sycophancy in Language Models.Mrinank Sharma, Meg Tong, Tomasz Korbak, David Duvenaud, Amanda Askell, Samuel R. Bowman, Esin Durmus, Zac Hatfield-Dodds, Scott R. Johnston, Shauna Kravec, Timothy Maxwell, Sam McCandlish, Kamal Ndousse, Oliver Rausch, Nicholas Schiefer, Da Yan, Miranda Zhang, Ethan Perez
2024ICMLDebating with More Persuasive LLMs Leads to More Truthful Answers.Akbir Khan, John Hughes, Dan Valentine, Laura Ruis, Kshitij Sachan, Ansh Radhakrishnan, Edward Grefenstette, Samuel R. Bowman, Tim Rocktschel, Ethan Perez
2023ACLInstruction Induction: From Few Examples to Natural Language Task Descriptions.Or Honovich, Uri Shaham, Samuel R. Bowman, Omer Levy
2023ACL(QA)²: Question Answering with Questionable Assumptions.Najoung Kim, Phu Mon Htut, Samuel R. Bowman, Jackson Petty
2023ACLWhat Do NLP Researchers Believe? Results of the NLP Community Metasurvey.Julian Michael, Ari Holtzman, Alicia Parrish, Aaron Mueller, Alex Wang, Angelica Chen, Divyam Madaan, Nikita Nangia, Richard Yuanzhe Pang, Jason Phang, Samuel R. Bowman
2023ACLDiscovering Language Model Behaviors with Model-Written Evaluations.Ethan Perez, Sam Ringer, Kamile Lukosiute, Karina Nguyen, Edwin Chen, Scott Heiner, Craig Pettit, Catherine Olsson, Sandipan Kundu, Saurav Kadavath, Andy Jones, Anna Chen, Benjamin Mann, Brian Israel, Bryan Seethor, Cameron McKinnon, Christopher Olah, Da Yan, Daniela Amodei, Dario Amodei, Dawn Drain, Dustin Li, Eli Tran-Johnson, Guro Khundadze, Jackson Kernion, James Landis, Jamie Kerr, Jared Mueller, Jeeyoon Hyun, Joshua Landau, Kamal Ndousse, Landon Goldberg, Liane Lovitt, Martin Lucas, Michael Sellitto, Miranda Zhang, Neerav Kingsland, Nelson Elhage, Nicholas Joseph, Noem Mercado, Nova DasSarma, Oliver Rausch, Robin Larson, Sam McCandlish, Scott Johnston, Shauna Kravec, Sheer El Showk, Tamera Lanham, Timothy Telleen-Lawton, Tom Brown, Tom Henighan, Tristan Hume, Yuntao Bai, Zac Hatfield-Dodds, Jack Clark, Samuel R. Bowman, Amanda Askell, Roger B. Grosse, Danny Hernandez, Deep Ganguli, Evan Hubinger, Nicholas Schiefer, Jared Kaplan
2023ACLScoNe: Benchmarking Negation Reasoning in Language Models With Fine-Tuning and In-Context Learning.Jingyuan Selena She, Christopher Potts, Samuel R. Bowman, Atticus Geiger
2023ICMLPretraining Language Models with Human Preferences.Tomasz Korbak, Kejian Shi, Angelica Chen, Rasika Vinayak Bhalerao, Christopher L. Buckley, Jason Phang, Samuel R. Bowman, Ethan Perez
2022ACLThe Dangers of Underclaiming: Reasons for Caution When Reporting How NLP Systems Fail.Samuel R. Bowman
2022ACLBBQ: A hand-built bias benchmark for question answering.Alicia Parrish, Angelica Chen, Nikita Nangia, Vishakh Padmakumar, Jason Phang, Jana Thompson, Phu Mon Htut, Samuel R. Bowman
2022ACLWhat Makes Reading Comprehension Questions Difficult?Saku Sugawara, Nikita Nangia, Alex Warstadt, Samuel R. Bowman
2022EMNLPSocioProbe: What, When, and Where Language Models Learn about Sociodemographics.Anne Lauscher, Federico Bianchi, Samuel R. Bowman, Dirk Hovy
2022EMNLPSQuALITY: Building a Long-Document Summarization Dataset the Hard Way.Alex Wang, Richard Yuanzhe Pang, Angelica Chen, Jason Phang, Samuel R. Bowman
2022NAACLQuALITY: Question Answering with Long Input Texts, Yes!Richard Yuanzhe Pang, Alicia Parrish, Nitish Joshi, Nikita Nangia, Jason Phang, Angelica Chen, Vishakh Padmakumar, Johnny Ma, Jana Thompson, He He, Samuel R. Bowman
2021ACLWhat Ingredients Make for an Effective Crowdsourcing Protocol for Difficult NLU Data Collection Tasks?Nikita Nangia, Saku Sugawara, Harsh Trivedi, Alex Warstadt, Clara Vania, Samuel R. Bowman
2021ACLComparing Test Sets with Item Response Theory.Clara Vania, Phu Mon Htut, William Huang, Dhara A. Mungra, Richard Yuanzhe Pang, Jason Phang, Haokun Liu, Kyunghyun Cho, Samuel R. Bowman
2021ACLWhen Do You Need Billions of Words of Pretraining Data?Yian Zhang, Alex Warstadt, Xiaocheng Li, Samuel R. Bowman
2021CoNLLNOPE: A Corpus of Naturally-Occurring Presuppositions in English.Alicia Parrish, Sebastian Schuster, Alex Warstadt, Omar Agha, Soo-Hwan Lee, Zhuoye Zhao, Samuel R. Bowman, Tal Linzen
2021EMNLPDoes Putting a Linguist in the Loop Improve NLU Data Collection?Alicia Parrish, William Huang, Omar Agha, Soo-Hwan Lee, Nikita Nangia, Alex Warstadt, Karmanya Aggarwal, Emily Allaway, Tal Linzen, Samuel R. Bowman
2021EMNLPCrowdsourcing Beyond Annotation: Case Studies in Benchmark Data Collection.Alane Suhr, Clara Vania, Nikita Nangia, Maarten Sap, Mark Yatskar, Samuel R. Bowman, Yoav Artzi
2021NAACLWhat Will it Take to Fix Benchmarking in Natural Language Understanding?Samuel R. Bowman, George E. Dahl
2020AAAILearning to Learn Morphological Inflection for Resource-Poor Languages.Katharina Kann, Samuel R. Bowman, Kyunghyun Cho
2020ACLIntermediate-Task Transfer Learning with Pretrained Language Models: When and Why Does It Work?Yada Pruksachatkun, Jason Phang, Haokun Liu, Phu Mon Htut, Xiaoyi Zhang, Richard Yuanzhe Pang, Clara Vania, Katharina Kann, Samuel R. Bowman
2020ACLjiant: A Software Toolkit for Research on General-Purpose Text Understanding Models.Yada Pruksachatkun, Philip Yeres, Haokun Liu, Jason Phang, Phu Mon Htut, Alex Wang, Ian Tenney, Samuel R. Bowman
2020CogSciCan neural networks acquire a structural bias from raw linguistic data?Alex Warstadt, Samuel R. Bowman
2020EMNLPNew Protocols and Negative Results for Textual Entailment Data Collection.Samuel R. Bowman, Jennimaria Palomaki, Livio Baldini Soares, Emily Pitler
2020EMNLPPrecise Task Formalization Matters in Winograd Schema Evaluations.Haokun Liu, William Huang, Dhara A. Mungra, Samuel R. Bowman
2020EMNLPCrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models.Nikita Nangia, Clara Vania, Rasika Bhalerao, Samuel R. Bowman
2020EMNLPLearning Which Features Matter: RoBERTa Acquires a Preference for Linguistic Generalizations (Eventually).Alex Warstadt, Yian Zhang, Xiaocheng Li, Haokun Liu, Samuel R. Bowman
2020IJCNLPEnglish Intermediate-Task Training Improves Zero-Shot Cross-Lingual Transfer Too.Jason Phang, Iacer Calixto, Phu Mon Htut, Yada Pruksachatkun, Haokun Liu, Clara Vania, Katharina Kann, Samuel R. Bowman
2020IJCNLPAsking Crowdworkers to Write Entailment Examples: The Best of Bad Options.Clara Vania, Ruijie Chen, Samuel R. Bowman
2019ACLHuman vs. Muppet: A Conservative Estimate of Human Performance on the GLUE Benchmark.Nikita Nangia, Samuel R. Bowman
2019ACLCan You Tell Me How to Get Past Sesame Street? Sentence-Level Pretraining Beyond Language Modeling.Alex Wang, Jan Hula, Patrick Xia, Raghavendra Pappagari, R. Thomas McCoy, Roma Patel, Najoung Kim, Ian Tenney, Yinghui Huang, Katherin Yu, Shuning Jin, Berlin Chen, Benjamin Van Durme, Edouard Grave, Ellie Pavlick, Samuel R. Bowman
2019EMNLPTowards Realistic Practices In Low-Resource Natural Language Processing: The Development Set.Katharina Kann, Kyunghyun Cho, Samuel R. Bowman
2019EMNLPInvestigating BERT's Knowledge of Language: Five Analysis Methods with NPIs.Alex Warstadt, Yu Cao, Ioana Grosu, Wei Peng, Hagen Blix, Yining Nie, Anna Alsop, Shikha Bordia, Haokun Liu, Alicia Parrish, Sheng-Fu Wang, Jason Phang, Anhad Mohananey, Phu Mon Htut, Paloma Jeretic, Samuel R. Bowman
2019ICLRWhat do you learn from context? Probing for sentence structure in contextualized word representations.Ian Tenney, Patrick Xia, Berlin Chen, Alex Wang, Adam Poliak, R. Thomas McCoy, Najoung Kim, Benjamin Van Durme, Samuel R. Bowman, Dipanjan Das, Ellie Pavlick
2019ICLRGLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding.Alex Wang, Amanpreet Singh, Julian Michael, Felix Hill, Omer Levy, Samuel R. Bowman
2019NAACLIdentifying and Reducing Gender Bias in Word-Level Language Models.Shikha Bordia, Samuel R. Bowman
2019NAACLDeep Learning for Natural Language Inference.Samuel R. Bowman, Xiaodan Zhu
2019NAACLOn Measuring Social Biases in Sentence Encoders.Chandler May, Alex Wang, Shikha Bordia, Samuel R. Bowman, Rachel Rudinger
2018ACLRuminating Reader: Reasoning with Gated Multi-hop Attention.Yichen Gong, Samuel R. Bowman
2018CoNLLThe Lifted Matrix-Space Model for Semantic Composition.Woojin Chung, Sheng-Fu Wang, Samuel R. Bowman
2018EMNLPA Stable and Effective Learning Strategy for Trainable Greedy Decoding.Yun Chen, Victor O. K. Li, Kyunghyun Cho, Samuel R. Bowman
2018EMNLPXNLI: Evaluating Cross-lingual Sentence Representations.Alexis Conneau, Ruty Rinott, Guillaume Lample, Adina Williams, Samuel R. Bowman, Holger Schwenk, Veselin Stoyanov
2018EMNLPGrammar Induction with Neural Language Models: An Unusual Replication.Phu Mon Htut, Kyunghyun Cho, Samuel R. Bowman
2018EMNLPGrammar Induction with Neural Language Models: An Unusual Replication.Phu Mon Htut, Kyunghyun Cho, Samuel R. Bowman
2018EMNLPGLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding.Alex Wang, Amanpreet Singh, Julian Michael, Felix Hill, Omer Levy, Samuel R. Bowman
2018EMNLPLanguage Modeling Teaches You More than Translation Does: Lessons Learned Through Auxiliary Syntactic Task Analysis.Kelly W. Zhang, Samuel R. Bowman
2018ICLRStable and Effective Trainable Greedy Decoding for Sequence to Sequence Learning.Yun Chen, Kyunghyun Cho, Samuel R. Bowman, Victor O. K. Li
2018NAACLAnnotation Artifacts in Natural Language Inference Data.Suchin Gururangan, Swabha Swayamdipta, Omer Levy, Roy Schwartz, Samuel R. Bowman, Noah A. Smith
2018NAACLTraining a Ranking Function for Open-Domain Question Answering.Phu Mon Htut, Samuel R. Bowman, Kyunghyun Cho
2018NAACLListOps: A Diagnostic Dataset for Latent Tree Learning.Nikita Nangia, Samuel R. Bowman
2018NAACLA Broad-Coverage Challenge Corpus for Sentence Understanding through Inference.Adina Williams, Nikita Nangia, Samuel R. Bowman
2016ACLA Fast Unified Model for Parsing and Sentence Understanding.Samuel R. Bowman, Jon Gauthier, Abhinav Rastogi, Raghav Gupta, Christopher D. Manning, Christopher Potts
2016CoNLLGenerating Sentences from a Continuous Space.Samuel R. Bowman, Luke Vilnis, Oriol Vinyals, Andrew M. Dai, Rafal Jzefowicz, Samy Bengio
2015EMNLPA large annotated corpus for learning natural language inference.Samuel R. Bowman, Gabor Angeli, Christopher Potts, Christopher D. Manning
2014LRECA Gold Standard Dependency Corpus for English.Natalia Silveira, Timothy Dozat, Marie-Catherine de Marneffe, Samuel R. Bowman, Miriam Connor, John Bauer, Christopher D. Manning
2012NAACLAutomatic Animacy Classification.Samuel R. Bowman, Harshit Chopra
2011ICASSPSpeech recognitionwith segmental conditional random fields: A summary of the JHU CLSP 2010 Summer Workshop.Geoffrey Zweig, Patrick Nguyen, Dirk Van Compernolle, Kris Demuynck, Les E. Atlas, Pascal Clark, Gregory Sell, Meihong Wang, Fei Sha, Hynek Hermansky, Damianos Karakos, Aren Jansen, Samuel Thomas, Sivaram G. S. V. S., Samuel R. Bowman, Justine T. Kao
2010InterspeechModeling pronunciation variation with context-dependent articulatory feature decision trees.Samuel R. Bowman, Karen Livescu