Tinghao Xie
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
9
Venues
4
Active years
2022–2026
Best venue rank
A*
Where they publish
Papers
9 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | Red-Teaming NSFW Image Classifiers as Text-to-Image Safeguards. | Tinghao Xie, Yueqi Xie, Alireza Zareian, Shuming Hu, Felix Juefei-Xu, Xiaowen Lin, Ankit Jain, Prateek Mittal, Li Chen |
| 2025 | ICLR | Fantastic Copyrighted Beasts and How (Not) to Generate Them. | Luxi He, Yangsibo Huang, Weijia Shi, Tinghao Xie, Haotian Liu, Yue Wang, Luke Zettlemoyer, Chiyuan Zhang, Danqi Chen, Peter Henderson |
| 2025 | ICLR | On Evaluating the Durability of Safeguards for Open-Weight LLMs. | Xiangyu Qi, Boyi Wei, Nicholas Carlini, Yangsibo Huang, Tinghao Xie, Luxi He, Matthew Jagielski, Milad Nasr, Prateek Mittal, Peter Henderson |
| 2025 | ICLR | SORRY-Bench: Systematically Evaluating Large Language Model Safety Refusal. | Tinghao Xie, Xiangyu Qi, Yi Zeng, Yangsibo Huang, Udari Madhushani Sehwag, Kaixuan Huang, Luxi He, Boyi Wei, Dacheng Li, Ying Sheng, Ruoxi Jia, Bo Li, Kai Li, Danqi Chen, Peter Henderson, Prateek Mittal |
| 2024 | ICLR | Fine-tuning Aligned Language Models Compromises Safety, Even When Users Do Not Intend To! | Xiangyu Qi, Yi Zeng, Tinghao Xie, Pin-Yu Chen, Ruoxi Jia, Prateek Mittal, Peter Henderson |
| 2024 | ICLR | BaDExpert: Extracting Backdoor Functionality for Accurate Backdoor Input Detection. | Tinghao Xie, Xiangyu Qi, Ping He, Yiming Li, Jiachen T. Wang, Prateek Mittal |
| 2024 | ICML | Assessing the Brittleness of Safety Alignment via Pruning and Low-Rank Modifications. | Boyi Wei, Kaixuan Huang, Yangsibo Huang, Tinghao Xie, Xiangyu Qi, Mengzhou Xia, Prateek Mittal, Mengdi Wang, Peter Henderson |
| 2023 | ICLR | Revisiting the Assumption of Latent Separability for Backdoor Defenses. | Xiangyu Qi, Tinghao Xie, Yiming Li, Saeed Mahloujifar, Prateek Mittal |
| 2022 | CVPR | Towards Practical Deployment-Stage Backdoor Attack on Deep Neural Networks. | Xiangyu Qi, Tinghao Xie, Ruizhe Pan, Jifeng Zhu, Yong Yang, Kai Bu |