Skip to content

Do as I do (Safely): Mitigating Task-Specific Fine-tuning Risks in Large Language Models.

Francisco Eiras, Aleksandar Petrov, Philip Torr, M. Pawan Kumar, Adel Bibi

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.