Skip to content

Ethan Perez

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

21

Venues

7

Active years

2018–2026

Best venue rank

A*

Where they publish

Papers

21 indexed papers, newest first.

YearVenueTitleAuthors
2026SIGCSEIntegrating Computer Science in Middle School Lessons through Block-Based Coding.Shreelakshya Reddi, Ethan Perez, Veronica Catet
2025ICLRLooking Inward: Language Models Can Learn About Themselves by Introspection.Felix Jedidja Binder, James Chua, Tomek Korbak, Henry Sleight, John Hughes, Robert Long, Ethan Perez, Miles Turpin, Owain Evans
2025ICLRFailures to Find Transferable Image Jailbreaks Between Vision-Language Models.Rylan Schaeffer, Dan Valentine, Luke Bailey, James Chua, Cristbal Eyzaguirre, Zane Durante, Joe Benton, Brando Miranda, Henry Sleight, Tony Tong Wang, John Hughes, Rajashree Agrawal, Mrinank Sharma, Scott Emmons, Sanmi Koyejo, Ethan Perez
2025ICLRAdaptive Deployment of Untrusted LLMs Reduces Distributed Threats.Jiaxin Wen, Vivek Hebbar, Caleb Larson, Aryan Bhatt, Ansh Radhakrishnan, Mrinank Sharma, Henry Sleight, Shi Feng, He He, Ethan Perez, Buck Shlegeris, Akbir Khan
2025ICLRLanguage Models Learn to Mislead Humans via RLHF.Jiaxin Wen, Ruiqi Zhong, Akbir Khan, Ethan Perez, Jacob Steinhardt, Minlie Huang, Samuel R. Bowman, He He, Shi Feng
2024ICLRVision-Language Models are Zero-Shot Reward Models for Reinforcement Learning.Juan Rocamonde, Victoriano Montesinos, Elvis Nava, Ethan Perez, David Lindner
2024ICLRTowards Understanding Sycophancy in Language Models.Mrinank Sharma, Meg Tong, Tomasz Korbak, David Duvenaud, Amanda Askell, Samuel R. Bowman, Esin Durmus, Zac Hatfield-Dodds, Scott R. Johnston, Shauna Kravec, Timothy Maxwell, Sam McCandlish, Kamal Ndousse, Oliver Rausch, Nicholas Schiefer, Da Yan, Miranda Zhang, Ethan Perez
2024ICMLDebating with More Persuasive LLMs Leads to More Truthful Answers.Akbir Khan, John Hughes, Dan Valentine, Laura Ruis, Kshitij Sachan, Ansh Radhakrishnan, Edward Grefenstette, Samuel R. Bowman, Tim Rocktschel, Ethan Perez
2023ACLFew-shot Adaptation Works with UnpredicTable Data.Jun Shern Chan, Michael Pieler, Jonathan Jao, Jrmy Scheurer, Ethan Perez
2023ACLDiscovering Language Model Behaviors with Model-Written Evaluations.Ethan Perez, Sam Ringer, Kamile Lukosiute, Karina Nguyen, Edwin Chen, Scott Heiner, Craig Pettit, Catherine Olsson, Sandipan Kundu, Saurav Kadavath, Andy Jones, Anna Chen, Benjamin Mann, Brian Israel, Bryan Seethor, Cameron McKinnon, Christopher Olah, Da Yan, Daniela Amodei, Dario Amodei, Dawn Drain, Dustin Li, Eli Tran-Johnson, Guro Khundadze, Jackson Kernion, James Landis, Jamie Kerr, Jared Mueller, Jeeyoon Hyun, Joshua Landau, Kamal Ndousse, Landon Goldberg, Liane Lovitt, Martin Lucas, Michael Sellitto, Miranda Zhang, Neerav Kingsland, Nelson Elhage, Nicholas Joseph, Noem Mercado, Nova DasSarma, Oliver Rausch, Robin Larson, Sam McCandlish, Scott Johnston, Shauna Kravec, Sheer El Showk, Tamera Lanham, Timothy Telleen-Lawton, Tom Brown, Tom Henighan, Tristan Hume, Yuntao Bai, Zac Hatfield-Dodds, Jack Clark, Samuel R. Bowman, Amanda Askell, Roger B. Grosse, Danny Hernandez, Deep Ganguli, Evan Hubinger, Nicholas Schiefer, Jared Kaplan
2023ICMLPretraining Language Models with Human Preferences.Tomasz Korbak, Kejian Shi, Angelica Chen, Rasika Vinayak Bhalerao, Christopher L. Buckley, Jason Phang, Samuel R. Bowman, Ethan Perez
2022EMNLPRL with KL penalties is better viewed as Bayesian inference.Tomasz Korbak, Ethan Perez, Christopher L. Buckley
2022EMNLPRed Teaming Language Models with Language Models.Ethan Perez, Saffron Huang, H. Francis Song, Trevor Cai, Roman Ring, John Aslanides, Amelia Glaese, Nat McAleese, Geoffrey Irving
2021EMNLPCase-based Reasoning for Natural Language Queries over Knowledge Bases.Rajarshi Das, Manzil Zaheer, Dung Thai, Ameya Godbole, Ethan Perez, Jay Yoon Lee, Lizhen Tan, Lazaros Polymenakos, Andrew McCallum
2021ICMLRissanen Data Analysis: Examining Dataset Characteristics via Description Length.Ethan Perez, Douwe Kiela, Kyunghyun Cho
2020EMNLPUnsupervised Question Decomposition for Question Answering.Ethan Perez, Patrick Lewis, Wen-tau Yih, Kyunghyun Cho, Douwe Kiela
2019ACLELI5: Long Form Question Answering.Angela Fan, Yacine Jernite, Ethan Perez, David Grangier, Jason Weston, Michael Auli
2019EMNLPFinding Generalizable Evidence by Learning to Convince Q&A Models.Ethan Perez, Siddharth Karamcheti, Rob Fergus, Jason Weston, Douwe Kiela, Kyunghyun Cho
2018AAAIFiLM: Visual Reasoning with a General Conditioning Layer.Ethan Perez, Florian Strub, Harm de Vries, Vincent Dumoulin, Aaron C. Courville
2018ECCVVisual Reasoning with Multi-hop Feature Modulation.Florian Strub, Mathieu Seurin, Ethan Perez, Harm de Vries, Jrmie Mary, Philippe Preux, Aaron C. Courville, Olivier Pietquin
2018ICLRHoME: a Household Multimodal Environment.Simon Brodeur, Ethan Perez, Ankesh Anand, Florian Golemo, Luca Celotti, Florian Strub, Jean Rouat, Hugo Larochelle, Aaron C. Courville