Yangsibo Huang
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
20
Venues
5
Active years
2019–2025
Best venue rank
A*
Where they publish
Papers
20 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ICLR | Fantastic Copyrighted Beasts and How (Not) to Generate Them. | Luxi He, Yangsibo Huang, Weijia Shi, Tinghao Xie, Haotian Liu, Yue Wang, Luke Zettlemoyer, Chiyuan Zhang, Danqi Chen, Peter Henderson |
| 2025 | ICLR | Unlearn and Burn: Adversarial Machine Unlearning Requests Destroy Model Accuracy. | Yangsibo Huang, Daogao Liu, Lynn Chua, Badih Ghazi, Pritish Kamath, Ravi Kumar, Pasin Manurangsi, Milad Nasr, Amer Sinha, Chiyuan Zhang |
| 2025 | ICLR | On Evaluating the Durability of Safeguards for Open-Weight LLMs. | Xiangyu Qi, Boyi Wei, Nicholas Carlini, Yangsibo Huang, Tinghao Xie, Luxi He, Matthew Jagielski, Milad Nasr, Prateek Mittal, Peter Henderson |
| 2025 | ICLR | MUSE: Machine Unlearning Six-Way Evaluation for Language Models. | Weijia Shi, Jaechan Lee, Yangsibo Huang, Sadhika Malladi, Jieyu Zhao, Ari Holtzman, Daogao Liu, Luke Zettlemoyer, Noah A. Smith, Chiyuan Zhang |
| 2025 | ICLR | SORRY-Bench: Systematically Evaluating Large Language Model Safety Refusal. | Tinghao Xie, Xiangyu Qi, Yi Zeng, Yangsibo Huang, Udari Madhushani Sehwag, Kaixuan Huang, Luxi He, Boyi Wei, Dacheng Li, Ying Sheng, Ruoxi Jia, Bo Li, Kai Li, Danqi Chen, Peter Henderson, Prateek Mittal |
| 2025 | ICLR | GMValuator: Similarity-based Data Valuation for Generative Models. | Jiaxi Yang, Wenlong Deng, Benlin Liu, Yangsibo Huang, James Zou, Xiaoxiao Li |
| 2025 | ICML | MATH-Perturb: Benchmarking LLMs' Math Reasoning Abilities against Hard Perturbations. | Kaixuan Huang, Jiacheng Guo, Zihao Li, Xiang Ji, Jiawei Ge, Wenzhe Li, Yingqing Guo, Tianle Cai, Hui Yuan, Runzhe Wang, Yue Wu, Ming Yin, Shange Tang, Yangsibo Huang, Chi Jin, Xinyun Chen, Chiyuan Zhang, Mengdi Wang |
| 2025 | ICML | Exploring and Mitigating Adversarial Manipulation of Voting-Based Leaderboards. | Yangsibo Huang, Milad Nasr, Anastasios Nikolas Angelopoulos, Nicholas Carlini, Wei-Lin Chiang, Christopher A. Choquette-Choo, Daphne Ippolito, Matthew Jagielski, Katherine Lee, Ken Liu, Ion Stoica, Florian Tramr, Chiyuan Zhang |
| 2025 | ICML | Scaling Laws for Differentially Private Language Models. | Ryan McKenna, Yangsibo Huang, Amer Sinha, Borja Balle, Zachary Charles, Christopher A. Choquette-Choo, Badih Ghazi, Georgios Kaissis, Ravi Kumar, Ruibo Liu, Da Yu, Chiyuan Zhang |
| 2025 | IJCNLP | On Memorization of Large Language Models in Logical Reasoning. | Chulin Xie, Yangsibo Huang, Chiyuan Zhang, Da Yu, Xinyun Chen, Bill Yuchen Lin, Bo Li, Badih Ghazi, Ravi Kumar |
| 2024 | ICLR | LabelDP-Pro: Learning with Label Differential Privacy via Projections. | Badih Ghazi, Yangsibo Huang, Pritish Kamath, Ravi Kumar, Pasin Manurangsi, Chiyuan Zhang |
| 2024 | ICLR | Catastrophic Jailbreak of Open-source LLMs via Exploiting Generation. | Yangsibo Huang, Samyak Gupta, Mengzhou Xia, Kai Li, Danqi Chen |
| 2024 | ICLR | Detecting Pretraining Data from Large Language Models. | Weijia Shi, Anirudh Ajith, Mengzhou Xia, Yangsibo Huang, Daogao Liu, Terra Blevins, Danqi Chen, Luke Zettlemoyer |
| 2024 | ICML | Position: A Safe Harbor for AI Evaluation and Red Teaming. | Shayne Longpre, Sayash Kapoor, Kevin Klyman, Ashwin Ramaswami, Rishi Bommasani, Borhane Blili-Hamelin, Yangsibo Huang, Aviya Skowron, Zheng Xin Yong, Suhas Kotha, Yi Zeng, Weiyan Shi, Xianjun Yang, Reid Southen, Alexander Robey, Patrick Chao, Diyi Yang, Ruoxi Jia, Daniel Kang, Sandy Pentland, Arvind Narayanan, Percy Liang, Peter Henderson |
| 2024 | ICML | Assessing the Brittleness of Safety Alignment via Pruning and Low-Rank Modifications. | Boyi Wei, Kaixuan Huang, Yangsibo Huang, Tinghao Xie, Xiangyu Qi, Mengzhou Xia, Prateek Mittal, Mengdi Wang, Peter Henderson |
| 2023 | EMNLP | Privacy Implications of Retrieval-Based Language Models. | Yangsibo Huang, Samyak Gupta, Zexuan Zhong, Kai Li, Danqi Chen |
| 2021 | MICCAI | EMA: Auditing Data Removal from Trained Models. | Yangsibo Huang, Xiaoxiao Li, Kai Li |
| 2020 | EMNLP | TextHide: Tackling Data Privacy for Language Understanding Tasks. | Yangsibo Huang, Zhao Song, Danqi Chen, Kai Li, Sanjeev Arora |
| 2020 | ICML | InstaHide: Instance-hiding Schemes for Private Distributed Learning. | Yangsibo Huang, Zhao Song, Kai Li, Sanjeev Arora |
| 2019 | MICCAI | DeepMCDose: A Deep Learning Method for Efficient Monte Carlo Beamlet Dose Calculation by Predictive Denoising in MR-Guided Radiotherapy. | Ryan Neph, Yangsibo Huang, Youming Yang, Ke Sheng |