Skip to content

Antidote: Post-fine-tuning Safety Alignment for Large Language Models against Harmful Fine-tuning Attack.

Tiansheng Huang, Gautam Bhattacharya, Pratik Joshi, Joshua Kimball, Ling Liu

VenueA*ICML
Year2025
ProceedingsICML

Browse the full ICML paper archive.