Dan Hendrycks
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
22
Venues
7
Active years
2017–2025
Best venue rank
A*
Where they publish
Papers
22 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ICLR | AgentHarm: A Benchmark for Measuring Harmfulness of LLM Agents. | Maksym Andriushchenko, Alexandra Souly, Mateusz Dziemian, Derek Duenas, Maxwell Lin, Justin Wang, Dan Hendrycks, Andy Zou, J. Zico Kolter, Matt Fredrikson, Yarin Gal, Xander Davies |
| 2025 | ICLR | Tamper-Resistant Safeguards for Open-Weight LLMs. | Rishub Tamirisa, Bhrugu Bharathi, Long Phan, Andy Zhou, Alice Gatti, Tarun Suresh, Maxwell Lin, Justin Wang, Rowan Wang, Ron Arel, Andy Zou, Dawn Song, Bo Li, Dan Hendrycks, Mantas Mazeika |
| 2024 | ICML | Decoding Compressed Trust: Scrutinizing the Trustworthiness of Efficient LLMs Under Compression. | Junyuan Hong, Jinhao Duan, Chenhui Zhang, Zhangheng Li, Chulin Xie, Kelsey Lieberman, James Diffenderfer, Brian R. Bartoldson, Ajay Kumar Jaiswal, Kaidi Xu, Bhavya Kailkhura, Dan Hendrycks, Dawn Song, Zhangyang Wang, Bo Li |
| 2024 | ICML | The WMDP Benchmark: Measuring and Reducing Malicious Use with Unlearning. | Nathaniel Li, Alexander Pan, Anjali Gopal, Summer Yue, Daniel Berrios, Alice Gatti, Justin D. Li, Ann-Kathrin Dombrowski, Shashwat Goel, Gabriel Mukobi, Nathan Helm-Burger, Rassin Lababidi, Lennart Justen, Andrew B. Liu, Michael Chen, Isabelle Barrass, Oliver Zhang, Xiaoyuan Zhu, Rishub Tamirisa, Bhrugu Bharathi, Ariel Herbert-Voss, Cort B. Breuer, Andy Zou, Mantas Mazeika, Zifan Wang, Palash Oswal, Weiran Lin, Adam A. Hunt, Justin Tienken-Harder, Kevin Y. Shih, Kemper Talley, John Guan, Ian Steneker, David Campbell, Brad Jokubaitis, Steven Basart, Stephen Fitz, Ponnurangam Kumaraguru, Kallol Krishna Karmakar, Uday Kiran Tupakula, Vijay Varadharajan, Yan Shoshitaishvili, Jimmy Ba, Kevin M. Esvelt, Alexandr Wang, Dan Hendrycks |
| 2024 | ICML | HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal. | Mantas Mazeika, Long Phan, Xuwang Yin, Andy Zou, Zifan Wang, Norman Mu, Elham Sakhaee, Nathaniel Li, Steven Basart, Bo Li, David A. Forsyth, Dan Hendrycks |
| 2023 | EMNLP | MAUD: An Expert-Annotated Legal NLP Dataset for Merger Agreement Understanding. | Steven H. Wang, Antoine Scardigli, Leonard Tang, Wei Chen, Dimitry Levkin, Anya Chen, Spencer Ball, Thomas Woodside, Oliver Zhang, Dan Hendrycks |
| 2023 | ICML | Do the Rewards Justify the Means? Measuring Trade-Offs Between Rewards and Ethical Behavior in the Machiavelli Benchmark. | Alexander Pan, Jun Shern Chan, Andy Zou, Nathaniel Li, Steven Basart, Thomas Woodside, Hanlin Zhang, Scott Emmons, Dan Hendrycks |
| 2022 | CVPR | PixMix: Dreamlike Pictures Comprehensively Improve Safety Measures. | Dan Hendrycks, Andy Zou, Mantas Mazeika, Leonard Tang, Bo Li, Dawn Song, Jacob Steinhardt |
| 2022 | ECCV | A Spectral View of Randomized Smoothing Under Common Corruptions: Benchmarking and Improving Certified Robustness. | Jiachen Sun, Akshay Mehra, Bhavya Kailkhura, Pin-Yu Chen, Dan Hendrycks, Jihun Hamm, Z. Morley Mao |
| 2022 | ICML | Scaling Out-of-Distribution Detection for Real-World Settings. | Dan Hendrycks, Steven Basart, Mantas Mazeika, Andy Zou, Joseph Kwon, Mohammadreza Mostajabi, Jacob Steinhardt, Dawn Song |
| 2021 | CVPR | Natural Adversarial Examples. | Dan Hendrycks, Kevin Zhao, Steven Basart, Jacob Steinhardt, Dawn Song |
| 2021 | ICCV | The Many Faces of Robustness: A Critical Analysis of Out-of-Distribution Generalization. | Dan Hendrycks, Steven Basart, Norman Mu, Saurav Kadavath, Frank Wang, Evan Dorundo, Rahul Desai, Tyler Zhu, Samyak Parajuli, Mike Guo, Dawn Song, Jacob Steinhardt, Justin Gilmer |
| 2021 | ICLR | Aligning AI With Shared Human Values. | Dan Hendrycks, Collin Burns, Steven Basart, Andrew Critch, Jerry Li, Dawn Song, Jacob Steinhardt |
| 2021 | ICLR | Measuring Massive Multitask Language Understanding. | Dan Hendrycks, Collin Burns, Steven Basart, Andy Zou, Mantas Mazeika, Dawn Song, Jacob Steinhardt |
| 2020 | ACL | Pretrained Transformers Improve Out-of-Distribution Robustness. | Dan Hendrycks, Xiaoyuan Liu, Eric Wallace, Adam Dziedzic, Rishabh Krishnan, Dawn Song |
| 2020 | ICLR | AugMix: A Simple Data Processing Method to Improve Robustness and Uncertainty. | Dan Hendrycks, Norman Mu, Ekin Dogus Cubuk, Barret Zoph, Justin Gilmer, Balaji Lakshminarayanan |
| 2019 | ICLR | Benchmarking Neural Network Robustness to Common Corruptions and Perturbations. | Dan Hendrycks, Thomas G. Dietterich |
| 2019 | ICLR | Deep Anomaly Detection with Outlier Exposure. | Dan Hendrycks, Mantas Mazeika, Thomas G. Dietterich |
| 2019 | ICML | Using Pre-Training Can Improve Model Robustness and Uncertainty. | Dan Hendrycks, Kimin Lee, Mantas Mazeika |
| 2018 | ICML | Open Category Detection with PAC Guarantees. | Si Liu, Risheek Garrepalli, Thomas G. Dietterich, Alan Fern, Dan Hendrycks |
| 2017 | ICLR | A Baseline for Detecting Misclassified and Out-of-Distribution Examples in Neural Networks. | Dan Hendrycks, Kevin Gimpel |
| 2017 | ICLR | Early Methods for Detecting Adversarial Images. | Dan Hendrycks, Kevin Gimpel |