Skip to content

Yangsibo Huang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

20

Venues

5

Active years

2019–2025

Best venue rank

A*

Where they publish

Papers

20 indexed papers, newest first.

YearVenueTitleAuthors
2025ICLRFantastic Copyrighted Beasts and How (Not) to Generate Them.Luxi He, Yangsibo Huang, Weijia Shi, Tinghao Xie, Haotian Liu, Yue Wang, Luke Zettlemoyer, Chiyuan Zhang, Danqi Chen, Peter Henderson
2025ICLRUnlearn and Burn: Adversarial Machine Unlearning Requests Destroy Model Accuracy.Yangsibo Huang, Daogao Liu, Lynn Chua, Badih Ghazi, Pritish Kamath, Ravi Kumar, Pasin Manurangsi, Milad Nasr, Amer Sinha, Chiyuan Zhang
2025ICLROn Evaluating the Durability of Safeguards for Open-Weight LLMs.Xiangyu Qi, Boyi Wei, Nicholas Carlini, Yangsibo Huang, Tinghao Xie, Luxi He, Matthew Jagielski, Milad Nasr, Prateek Mittal, Peter Henderson
2025ICLRMUSE: Machine Unlearning Six-Way Evaluation for Language Models.Weijia Shi, Jaechan Lee, Yangsibo Huang, Sadhika Malladi, Jieyu Zhao, Ari Holtzman, Daogao Liu, Luke Zettlemoyer, Noah A. Smith, Chiyuan Zhang
2025ICLRSORRY-Bench: Systematically Evaluating Large Language Model Safety Refusal.Tinghao Xie, Xiangyu Qi, Yi Zeng, Yangsibo Huang, Udari Madhushani Sehwag, Kaixuan Huang, Luxi He, Boyi Wei, Dacheng Li, Ying Sheng, Ruoxi Jia, Bo Li, Kai Li, Danqi Chen, Peter Henderson, Prateek Mittal
2025ICLRGMValuator: Similarity-based Data Valuation for Generative Models.Jiaxi Yang, Wenlong Deng, Benlin Liu, Yangsibo Huang, James Zou, Xiaoxiao Li
2025ICMLMATH-Perturb: Benchmarking LLMs' Math Reasoning Abilities against Hard Perturbations.Kaixuan Huang, Jiacheng Guo, Zihao Li, Xiang Ji, Jiawei Ge, Wenzhe Li, Yingqing Guo, Tianle Cai, Hui Yuan, Runzhe Wang, Yue Wu, Ming Yin, Shange Tang, Yangsibo Huang, Chi Jin, Xinyun Chen, Chiyuan Zhang, Mengdi Wang
2025ICMLExploring and Mitigating Adversarial Manipulation of Voting-Based Leaderboards.Yangsibo Huang, Milad Nasr, Anastasios Nikolas Angelopoulos, Nicholas Carlini, Wei-Lin Chiang, Christopher A. Choquette-Choo, Daphne Ippolito, Matthew Jagielski, Katherine Lee, Ken Liu, Ion Stoica, Florian Tramr, Chiyuan Zhang
2025ICMLScaling Laws for Differentially Private Language Models.Ryan McKenna, Yangsibo Huang, Amer Sinha, Borja Balle, Zachary Charles, Christopher A. Choquette-Choo, Badih Ghazi, Georgios Kaissis, Ravi Kumar, Ruibo Liu, Da Yu, Chiyuan Zhang
2025IJCNLPOn Memorization of Large Language Models in Logical Reasoning.Chulin Xie, Yangsibo Huang, Chiyuan Zhang, Da Yu, Xinyun Chen, Bill Yuchen Lin, Bo Li, Badih Ghazi, Ravi Kumar
2024ICLRLabelDP-Pro: Learning with Label Differential Privacy via Projections.Badih Ghazi, Yangsibo Huang, Pritish Kamath, Ravi Kumar, Pasin Manurangsi, Chiyuan Zhang
2024ICLRCatastrophic Jailbreak of Open-source LLMs via Exploiting Generation.Yangsibo Huang, Samyak Gupta, Mengzhou Xia, Kai Li, Danqi Chen
2024ICLRDetecting Pretraining Data from Large Language Models.Weijia Shi, Anirudh Ajith, Mengzhou Xia, Yangsibo Huang, Daogao Liu, Terra Blevins, Danqi Chen, Luke Zettlemoyer
2024ICMLPosition: A Safe Harbor for AI Evaluation and Red Teaming.Shayne Longpre, Sayash Kapoor, Kevin Klyman, Ashwin Ramaswami, Rishi Bommasani, Borhane Blili-Hamelin, Yangsibo Huang, Aviya Skowron, Zheng Xin Yong, Suhas Kotha, Yi Zeng, Weiyan Shi, Xianjun Yang, Reid Southen, Alexander Robey, Patrick Chao, Diyi Yang, Ruoxi Jia, Daniel Kang, Sandy Pentland, Arvind Narayanan, Percy Liang, Peter Henderson
2024ICMLAssessing the Brittleness of Safety Alignment via Pruning and Low-Rank Modifications.Boyi Wei, Kaixuan Huang, Yangsibo Huang, Tinghao Xie, Xiangyu Qi, Mengzhou Xia, Prateek Mittal, Mengdi Wang, Peter Henderson
2023EMNLPPrivacy Implications of Retrieval-Based Language Models.Yangsibo Huang, Samyak Gupta, Zexuan Zhong, Kai Li, Danqi Chen
2021MICCAIEMA: Auditing Data Removal from Trained Models.Yangsibo Huang, Xiaoxiao Li, Kai Li
2020EMNLPTextHide: Tackling Data Privacy for Language Understanding Tasks.Yangsibo Huang, Zhao Song, Danqi Chen, Kai Li, Sanjeev Arora
2020ICMLInstaHide: Instance-hiding Schemes for Private Distributed Learning.Yangsibo Huang, Zhao Song, Kai Li, Sanjeev Arora
2019MICCAIDeepMCDose: A Deep Learning Method for Efficient Monte Carlo Beamlet Dose Calculation by Predictive Denoising in MR-Guided Radiotherapy.Ryan Neph, Yangsibo Huang, Youming Yang, Ke Sheng