Skip to content

Peter Henderson

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

43

Venues

20

Active years

1971–2025

Best venue rank

A*

Where they publish

Papers

43 indexed papers, newest first.

YearVenueTitleAuthors
2025AIESThe Model Hears You: Audio Language Model Deployments Should Consider the Principle of Least Privilege.Luxi He, Xiangyu Qi, Michel Liao, Inyoung Cheong, Prateek Mittal, Danqi Chen, Peter Henderson
2025ICLRFantastic Copyrighted Beasts and How (Not) to Generate Them.Luxi He, Yangsibo Huang, Weijia Shi, Tinghao Xie, Haotian Liu, Yue Wang, Luke Zettlemoyer, Chiyuan Zhang, Danqi Chen, Peter Henderson
2025ICLRSafety Alignment Should be Made More Than Just a Few Tokens Deep.Xiangyu Qi, Ashwinee Panda, Kaifeng Lyu, Xiao Ma, Subhrajit Roy, Ahmad Beirami, Prateek Mittal, Peter Henderson
2025ICLROn Evaluating the Durability of Safeguards for Open-Weight LLMs.Xiangyu Qi, Boyi Wei, Nicholas Carlini, Yangsibo Huang, Tinghao Xie, Luxi He, Matthew Jagielski, Milad Nasr, Prateek Mittal, Peter Henderson
2025ICLRSORRY-Bench: Systematically Evaluating Large Language Model Safety Refusal.Tinghao Xie, Xiangyu Qi, Yi Zeng, Yangsibo Huang, Udari Madhushani Sehwag, Kaixuan Huang, Luxi He, Boyi Wei, Dacheng Li, Ying Sheng, Ruoxi Jia, Bo Li, Kai Li, Danqi Chen, Peter Henderson, Prateek Mittal
2025ICMLPosition: In-House Evaluation Is Not Enough. Towards Robust Third-Party Evaluation and Flaw Disclosure for General-Purpose AI.Shayne Longpre, Kevin Klyman, Ruth Elisabeth Appel, Sayash Kapoor, Rishi Bommasani, Michelle Sahar, Sean McGregor, Avijit Ghosh, Borhane Blili-Hamelin, Nathan Butters, Alondra Nelson, Amit Elazari, Andrew Sellars, Casey John Ellis, Dane Sherrets, Dawn Song, Harley Geiger, Ilona Cohen, Lauren McIlvenny, Madhulika Srikumar, Mark M. Jaycox, Markus Anderljung, Nadine Farid Johnson, Nicholas Carlini, Nicolas Miailhe, Nik Marda, Peter Henderson, Rebecca S. Portnoff, Rebecca Weiss, Victoria Westerhoff, Yacine Jernite, Rumman Chowdhury, Percy Liang, Arvind Narayanan
2025NAACLLawInstruct: A Resource for Studying Language Model Adaptation to the Legal Domain.Joel Niklaus, Lucia Zheng, Arya D. McCarthy, Christopher Hahn, Brian M. Rosen, Peter Henderson, Daniel E. Ho, Garrett Honke, Percy Liang, Christopher D. Manning
2024AAAIVisual Adversarial Examples Jailbreak Aligned Large Language Models.Xiangyu Qi, Kaixuan Huang, Ashwinee Panda, Peter Henderson, Mengdi Wang, Prateek Mittal
2024ICLRFine-tuning Aligned Language Models Compromises Safety, Even When Users Do Not Intend To!Xiangyu Qi, Yi Zeng, Tinghao Xie, Pin-Yu Chen, Ruoxi Jia, Prateek Mittal, Peter Henderson
2024ICMLPosition: On the Societal Impact of Open Foundation Models.Sayash Kapoor, Rishi Bommasani, Kevin Klyman, Shayne Longpre, Ashwin Ramaswami, Peter Cihon, Aspen K. Hopkins, Kevin Bankston, Stella Biderman, Miranda Bogen, Rumman Chowdhury, Alex Engler, Peter Henderson, Yacine Jernite, Seth Lazar, Stefano Maffulli, Alondra Nelson, Joelle Pineau, Aviya Skowron, Dawn Song, Victor Storchan, Daniel Zhang, Daniel E. Ho, Percy Liang, Arvind Narayanan
2024ICMLPosition: A Safe Harbor for AI Evaluation and Red Teaming.Shayne Longpre, Sayash Kapoor, Kevin Klyman, Ashwin Ramaswami, Rishi Bommasani, Borhane Blili-Hamelin, Yangsibo Huang, Aviya Skowron, Zheng Xin Yong, Suhas Kotha, Yi Zeng, Weiyan Shi, Xianjun Yang, Reid Southen, Alexander Robey, Patrick Chao, Diyi Yang, Ruoxi Jia, Daniel Kang, Sandy Pentland, Arvind Narayanan, Percy Liang, Peter Henderson
2024ICMLAssessing the Brittleness of Safety Alignment via Pruning and Low-Rank Modifications.Boyi Wei, Kaixuan Huang, Yangsibo Huang, Tinghao Xie, Xiangyu Qi, Mengzhou Xia, Prateek Mittal, Mengdi Wang, Peter Henderson
2023AAAIIntegrating Reward Maximization and Population Estimation: Sequential Decision-Making for Internal Revenue Service Audit Selection.Peter Henderson, Ben Chugg, Brandon R. Anderson, Kristen M. Altenburger, Alex Turk, John Guyton, Jacob S. Goldin, Daniel E. Ho
2023AAAIEntropy Regularization for Population Estimation.Ben Chugg, Peter Henderson, Jacob S. Goldin, Daniel E. Ho
2023AIESSelf-Destructing Models: Increasing the Costs of Harmful Dual Uses of Foundation Models.Peter Henderson, Eric Mitchell, Christopher D. Manning, Dan Jurafsky, Chelsea Finn
2022IJCNLPText Characterization Toolkit (TCT).Daniel Simig, Tianlu Wang, Verna Dankers, Peter Henderson, Khuyagbaatar Batsuren, Dieuwke Hupkes, Mona T. Diab
2021ICAILWhen does pretraining help?: assessing self-supervised learning for law and the CaseHOLD dataset of 53, 000+ legal holdings.Lucia Zheng, Neel Guha, Brandon R. Anderson, Peter Henderson, Daniel E. Ho
2020EMNLPWith Little Power Comes Great Responsibility.Dallas Card, Peter Henderson, Urvashi Khandelwal, Robin Jia, Kyle Mahowald, Dan Jurafsky
2019ICMLSeparable value functions across time-scales.Joshua Romoff, Peter Henderson, Ahmed Touati, Yann Ollivier, Joelle Pineau, Emma Brunskill
2018AAAIOptionGAN: Learning Joint Reward-Policy Options Using Generative Adversarial Inverse Reinforcement Learning.Peter Henderson, Wei-Di Chang, Pierre-Luc Bacon, David Meger, Joelle Pineau, Doina Precup
2018AAAIDeep Reinforcement Learning That Matters.Peter Henderson, Riashat Islam, Philip Bachman, Joelle Pineau, Doina Precup, David Meger
2018AIESEthical Challenges in Data-Driven Dialogue Systems.Peter Henderson, Koustuv Sinha, Nicolas Angelard-Gontier, Nan Rosemary Ke, Genevieve Fried, Ryan Lowe, Joelle Pineau
2018CoRLReward Estimation for Variance Reduction in Deep Reinforcement Learning.Joshua Romoff, Peter Henderson, Alexandre Pich, Vincent Franois-Lavet, Joelle Pineau
2018ICLRReward Estimation for Variance Reduction in Deep Reinforcement Learning.Joshua Romoff, Alexandre Pich, Peter Henderson, Vincent Franois-Lavet, Joelle Pineau
2018IROSCost Adaptation for Robust Decentralized Swarm Behaviour.Peter Henderson, Matthew Vertescher, David Meger, Mark Coates
2017IROSUnderwater multi-robot convoying using visual tracking by detection.Florian Shkurti, Wei-Di Chang, Peter Henderson, Md Jahidul Islam, Juan Camilo Gamboa Higuera, Jimmy Li, Travis Manderson, Anqi Xu, Gregory Dudek, Junaed Sattar
2009ICSRConsistency Checking for Component Reuse in Open Systems.Peter Henderson, Matthew J. Henderson
2009SEKECollaborative Development of System Architecture - a Tool for Coping with Inconsistency.Peter Henderson, Matthew J. Henderson
2008COMPSACUtilising Located Functions to Model and Optimise Distributed Computations.Stephen Crouch, Peter Henderson, Robert John Walters
2008SEKESystem Architecture Induces Document Architecture.Peter Henderson, Nishadi De Silva
2007COMPSACDataWarp: Empowering Applications to Make Progress in the Face of Contradictory or Inconsistent Data.Stephen Crouch, Peter Henderson, Robert John Walters
2007SACSelecting a distributed agreement algorithm.Robert John Walters, Peter Henderson, Stephen Crouch
2005AINAA Practical Modelling Notation for Secure Distributed Computation.Yih-Jiun Lee, Peter Henderson
2004COMPSACImplementing Hierarchical Features in a Graphically Based Formal Modelling Language.Peter Henderson, Robert John Walters, Stephen Crouch
2004ICSRReusable Web Services.Peter Henderson, Jingtao Yang
2003COMPSACEffects of Introducing Survival Behaviours into Automated Negotiators.Peter Henderson, Stephen Crouch, Robert John Walters, Qinglai Ni
2003DAISDataWarp: Building Applications Which Make Progress in an Inconsistent World.Peter Henderson, Robert John Walters, Stephen Crouch, Qinglai Ni
2002ICECCSReasoning about Asynchronous Behaviour in Distributed Systems.Peter Henderson
1999RSPSystem Design Validation Using Formal Models.Peter Henderson, Robert John Walters
1998ICSRLaws for dynamic systems.Peter Henderson
1995ICECCSPOSD-a notation for presenting complex systems of processes.Peter Henderson, Graham D. Pratten
1976POPLA Lazy Evaluator.Peter Henderson, James H. Morris Jr.
1971IJCAIDerived Semantics for Some Programming Language Constructs.Peter Henderson