Samuel R. Bowman
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
61
Venues
12
Active years
2010–2025
Best venue rank
A*
Where they publish
Papers
61 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ICLR | Language Models Learn to Mislead Humans via RLHF. | Jiaxin Wen, Ruiqi Zhong, Akbir Khan, Ethan Perez, Jacob Steinhardt, Minlie Huang, Samuel R. Bowman, He He, Shi Feng |
| 2024 | ICLR | Towards Understanding Sycophancy in Language Models. | Mrinank Sharma, Meg Tong, Tomasz Korbak, David Duvenaud, Amanda Askell, Samuel R. Bowman, Esin Durmus, Zac Hatfield-Dodds, Scott R. Johnston, Shauna Kravec, Timothy Maxwell, Sam McCandlish, Kamal Ndousse, Oliver Rausch, Nicholas Schiefer, Da Yan, Miranda Zhang, Ethan Perez |
| 2024 | ICML | Debating with More Persuasive LLMs Leads to More Truthful Answers. | Akbir Khan, John Hughes, Dan Valentine, Laura Ruis, Kshitij Sachan, Ansh Radhakrishnan, Edward Grefenstette, Samuel R. Bowman, Tim Rocktschel, Ethan Perez |
| 2023 | ACL | Instruction Induction: From Few Examples to Natural Language Task Descriptions. | Or Honovich, Uri Shaham, Samuel R. Bowman, Omer Levy |
| 2023 | ACL | (QA)²: Question Answering with Questionable Assumptions. | Najoung Kim, Phu Mon Htut, Samuel R. Bowman, Jackson Petty |
| 2023 | ACL | What Do NLP Researchers Believe? Results of the NLP Community Metasurvey. | Julian Michael, Ari Holtzman, Alicia Parrish, Aaron Mueller, Alex Wang, Angelica Chen, Divyam Madaan, Nikita Nangia, Richard Yuanzhe Pang, Jason Phang, Samuel R. Bowman |
| 2023 | ACL | Discovering Language Model Behaviors with Model-Written Evaluations. | Ethan Perez, Sam Ringer, Kamile Lukosiute, Karina Nguyen, Edwin Chen, Scott Heiner, Craig Pettit, Catherine Olsson, Sandipan Kundu, Saurav Kadavath, Andy Jones, Anna Chen, Benjamin Mann, Brian Israel, Bryan Seethor, Cameron McKinnon, Christopher Olah, Da Yan, Daniela Amodei, Dario Amodei, Dawn Drain, Dustin Li, Eli Tran-Johnson, Guro Khundadze, Jackson Kernion, James Landis, Jamie Kerr, Jared Mueller, Jeeyoon Hyun, Joshua Landau, Kamal Ndousse, Landon Goldberg, Liane Lovitt, Martin Lucas, Michael Sellitto, Miranda Zhang, Neerav Kingsland, Nelson Elhage, Nicholas Joseph, Noem Mercado, Nova DasSarma, Oliver Rausch, Robin Larson, Sam McCandlish, Scott Johnston, Shauna Kravec, Sheer El Showk, Tamera Lanham, Timothy Telleen-Lawton, Tom Brown, Tom Henighan, Tristan Hume, Yuntao Bai, Zac Hatfield-Dodds, Jack Clark, Samuel R. Bowman, Amanda Askell, Roger B. Grosse, Danny Hernandez, Deep Ganguli, Evan Hubinger, Nicholas Schiefer, Jared Kaplan |
| 2023 | ACL | ScoNe: Benchmarking Negation Reasoning in Language Models With Fine-Tuning and In-Context Learning. | Jingyuan Selena She, Christopher Potts, Samuel R. Bowman, Atticus Geiger |
| 2023 | ICML | Pretraining Language Models with Human Preferences. | Tomasz Korbak, Kejian Shi, Angelica Chen, Rasika Vinayak Bhalerao, Christopher L. Buckley, Jason Phang, Samuel R. Bowman, Ethan Perez |
| 2022 | ACL | The Dangers of Underclaiming: Reasons for Caution When Reporting How NLP Systems Fail. | Samuel R. Bowman |
| 2022 | ACL | BBQ: A hand-built bias benchmark for question answering. | Alicia Parrish, Angelica Chen, Nikita Nangia, Vishakh Padmakumar, Jason Phang, Jana Thompson, Phu Mon Htut, Samuel R. Bowman |
| 2022 | ACL | What Makes Reading Comprehension Questions Difficult? | Saku Sugawara, Nikita Nangia, Alex Warstadt, Samuel R. Bowman |
| 2022 | EMNLP | SocioProbe: What, When, and Where Language Models Learn about Sociodemographics. | Anne Lauscher, Federico Bianchi, Samuel R. Bowman, Dirk Hovy |
| 2022 | EMNLP | SQuALITY: Building a Long-Document Summarization Dataset the Hard Way. | Alex Wang, Richard Yuanzhe Pang, Angelica Chen, Jason Phang, Samuel R. Bowman |
| 2022 | NAACL | QuALITY: Question Answering with Long Input Texts, Yes! | Richard Yuanzhe Pang, Alicia Parrish, Nitish Joshi, Nikita Nangia, Jason Phang, Angelica Chen, Vishakh Padmakumar, Johnny Ma, Jana Thompson, He He, Samuel R. Bowman |
| 2021 | ACL | What Ingredients Make for an Effective Crowdsourcing Protocol for Difficult NLU Data Collection Tasks? | Nikita Nangia, Saku Sugawara, Harsh Trivedi, Alex Warstadt, Clara Vania, Samuel R. Bowman |
| 2021 | ACL | Comparing Test Sets with Item Response Theory. | Clara Vania, Phu Mon Htut, William Huang, Dhara A. Mungra, Richard Yuanzhe Pang, Jason Phang, Haokun Liu, Kyunghyun Cho, Samuel R. Bowman |
| 2021 | ACL | When Do You Need Billions of Words of Pretraining Data? | Yian Zhang, Alex Warstadt, Xiaocheng Li, Samuel R. Bowman |
| 2021 | CoNLL | NOPE: A Corpus of Naturally-Occurring Presuppositions in English. | Alicia Parrish, Sebastian Schuster, Alex Warstadt, Omar Agha, Soo-Hwan Lee, Zhuoye Zhao, Samuel R. Bowman, Tal Linzen |
| 2021 | EMNLP | Does Putting a Linguist in the Loop Improve NLU Data Collection? | Alicia Parrish, William Huang, Omar Agha, Soo-Hwan Lee, Nikita Nangia, Alex Warstadt, Karmanya Aggarwal, Emily Allaway, Tal Linzen, Samuel R. Bowman |
| 2021 | EMNLP | Crowdsourcing Beyond Annotation: Case Studies in Benchmark Data Collection. | Alane Suhr, Clara Vania, Nikita Nangia, Maarten Sap, Mark Yatskar, Samuel R. Bowman, Yoav Artzi |
| 2021 | NAACL | What Will it Take to Fix Benchmarking in Natural Language Understanding? | Samuel R. Bowman, George E. Dahl |
| 2020 | AAAI | Learning to Learn Morphological Inflection for Resource-Poor Languages. | Katharina Kann, Samuel R. Bowman, Kyunghyun Cho |
| 2020 | ACL | Intermediate-Task Transfer Learning with Pretrained Language Models: When and Why Does It Work? | Yada Pruksachatkun, Jason Phang, Haokun Liu, Phu Mon Htut, Xiaoyi Zhang, Richard Yuanzhe Pang, Clara Vania, Katharina Kann, Samuel R. Bowman |
| 2020 | ACL | jiant: A Software Toolkit for Research on General-Purpose Text Understanding Models. | Yada Pruksachatkun, Philip Yeres, Haokun Liu, Jason Phang, Phu Mon Htut, Alex Wang, Ian Tenney, Samuel R. Bowman |
| 2020 | CogSci | Can neural networks acquire a structural bias from raw linguistic data? | Alex Warstadt, Samuel R. Bowman |
| 2020 | EMNLP | New Protocols and Negative Results for Textual Entailment Data Collection. | Samuel R. Bowman, Jennimaria Palomaki, Livio Baldini Soares, Emily Pitler |
| 2020 | EMNLP | Precise Task Formalization Matters in Winograd Schema Evaluations. | Haokun Liu, William Huang, Dhara A. Mungra, Samuel R. Bowman |
| 2020 | EMNLP | CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models. | Nikita Nangia, Clara Vania, Rasika Bhalerao, Samuel R. Bowman |
| 2020 | EMNLP | Learning Which Features Matter: RoBERTa Acquires a Preference for Linguistic Generalizations (Eventually). | Alex Warstadt, Yian Zhang, Xiaocheng Li, Haokun Liu, Samuel R. Bowman |
| 2020 | IJCNLP | English Intermediate-Task Training Improves Zero-Shot Cross-Lingual Transfer Too. | Jason Phang, Iacer Calixto, Phu Mon Htut, Yada Pruksachatkun, Haokun Liu, Clara Vania, Katharina Kann, Samuel R. Bowman |
| 2020 | IJCNLP | Asking Crowdworkers to Write Entailment Examples: The Best of Bad Options. | Clara Vania, Ruijie Chen, Samuel R. Bowman |
| 2019 | ACL | Human vs. Muppet: A Conservative Estimate of Human Performance on the GLUE Benchmark. | Nikita Nangia, Samuel R. Bowman |
| 2019 | ACL | Can You Tell Me How to Get Past Sesame Street? Sentence-Level Pretraining Beyond Language Modeling. | Alex Wang, Jan Hula, Patrick Xia, Raghavendra Pappagari, R. Thomas McCoy, Roma Patel, Najoung Kim, Ian Tenney, Yinghui Huang, Katherin Yu, Shuning Jin, Berlin Chen, Benjamin Van Durme, Edouard Grave, Ellie Pavlick, Samuel R. Bowman |
| 2019 | EMNLP | Towards Realistic Practices In Low-Resource Natural Language Processing: The Development Set. | Katharina Kann, Kyunghyun Cho, Samuel R. Bowman |
| 2019 | EMNLP | Investigating BERT's Knowledge of Language: Five Analysis Methods with NPIs. | Alex Warstadt, Yu Cao, Ioana Grosu, Wei Peng, Hagen Blix, Yining Nie, Anna Alsop, Shikha Bordia, Haokun Liu, Alicia Parrish, Sheng-Fu Wang, Jason Phang, Anhad Mohananey, Phu Mon Htut, Paloma Jeretic, Samuel R. Bowman |
| 2019 | ICLR | What do you learn from context? Probing for sentence structure in contextualized word representations. | Ian Tenney, Patrick Xia, Berlin Chen, Alex Wang, Adam Poliak, R. Thomas McCoy, Najoung Kim, Benjamin Van Durme, Samuel R. Bowman, Dipanjan Das, Ellie Pavlick |
| 2019 | ICLR | GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding. | Alex Wang, Amanpreet Singh, Julian Michael, Felix Hill, Omer Levy, Samuel R. Bowman |
| 2019 | NAACL | Identifying and Reducing Gender Bias in Word-Level Language Models. | Shikha Bordia, Samuel R. Bowman |
| 2019 | NAACL | Deep Learning for Natural Language Inference. | Samuel R. Bowman, Xiaodan Zhu |
| 2019 | NAACL | On Measuring Social Biases in Sentence Encoders. | Chandler May, Alex Wang, Shikha Bordia, Samuel R. Bowman, Rachel Rudinger |
| 2018 | ACL | Ruminating Reader: Reasoning with Gated Multi-hop Attention. | Yichen Gong, Samuel R. Bowman |
| 2018 | CoNLL | The Lifted Matrix-Space Model for Semantic Composition. | Woojin Chung, Sheng-Fu Wang, Samuel R. Bowman |
| 2018 | EMNLP | A Stable and Effective Learning Strategy for Trainable Greedy Decoding. | Yun Chen, Victor O. K. Li, Kyunghyun Cho, Samuel R. Bowman |
| 2018 | EMNLP | XNLI: Evaluating Cross-lingual Sentence Representations. | Alexis Conneau, Ruty Rinott, Guillaume Lample, Adina Williams, Samuel R. Bowman, Holger Schwenk, Veselin Stoyanov |
| 2018 | EMNLP | Grammar Induction with Neural Language Models: An Unusual Replication. | Phu Mon Htut, Kyunghyun Cho, Samuel R. Bowman |
| 2018 | EMNLP | Grammar Induction with Neural Language Models: An Unusual Replication. | Phu Mon Htut, Kyunghyun Cho, Samuel R. Bowman |
| 2018 | EMNLP | GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding. | Alex Wang, Amanpreet Singh, Julian Michael, Felix Hill, Omer Levy, Samuel R. Bowman |
| 2018 | EMNLP | Language Modeling Teaches You More than Translation Does: Lessons Learned Through Auxiliary Syntactic Task Analysis. | Kelly W. Zhang, Samuel R. Bowman |
| 2018 | ICLR | Stable and Effective Trainable Greedy Decoding for Sequence to Sequence Learning. | Yun Chen, Kyunghyun Cho, Samuel R. Bowman, Victor O. K. Li |
| 2018 | NAACL | Annotation Artifacts in Natural Language Inference Data. | Suchin Gururangan, Swabha Swayamdipta, Omer Levy, Roy Schwartz, Samuel R. Bowman, Noah A. Smith |
| 2018 | NAACL | Training a Ranking Function for Open-Domain Question Answering. | Phu Mon Htut, Samuel R. Bowman, Kyunghyun Cho |
| 2018 | NAACL | ListOps: A Diagnostic Dataset for Latent Tree Learning. | Nikita Nangia, Samuel R. Bowman |
| 2018 | NAACL | A Broad-Coverage Challenge Corpus for Sentence Understanding through Inference. | Adina Williams, Nikita Nangia, Samuel R. Bowman |
| 2016 | ACL | A Fast Unified Model for Parsing and Sentence Understanding. | Samuel R. Bowman, Jon Gauthier, Abhinav Rastogi, Raghav Gupta, Christopher D. Manning, Christopher Potts |
| 2016 | CoNLL | Generating Sentences from a Continuous Space. | Samuel R. Bowman, Luke Vilnis, Oriol Vinyals, Andrew M. Dai, Rafal Jzefowicz, Samy Bengio |
| 2015 | EMNLP | A large annotated corpus for learning natural language inference. | Samuel R. Bowman, Gabor Angeli, Christopher Potts, Christopher D. Manning |
| 2014 | LREC | A Gold Standard Dependency Corpus for English. | Natalia Silveira, Timothy Dozat, Marie-Catherine de Marneffe, Samuel R. Bowman, Miriam Connor, John Bauer, Christopher D. Manning |
| 2012 | NAACL | Automatic Animacy Classification. | Samuel R. Bowman, Harshit Chopra |
| 2011 | ICASSP | Speech recognitionwith segmental conditional random fields: A summary of the JHU CLSP 2010 Summer Workshop. | Geoffrey Zweig, Patrick Nguyen, Dirk Van Compernolle, Kris Demuynck, Les E. Atlas, Pascal Clark, Gregory Sell, Meihong Wang, Fei Sha, Hynek Hermansky, Damianos Karakos, Aren Jansen, Samuel Thomas, Sivaram G. S. V. S., Samuel R. Bowman, Justine T. Kao |
| 2010 | Interspeech | Modeling pronunciation variation with context-dependent articulatory feature decision trees. | Samuel R. Bowman, Karen Livescu |