Skip to content

Language Models are Homer Simpson! Safety Re-Alignment of Fine-tuned Language Models through Task Arithmetic.

Rishabh Bhardwaj, Do Duc Anh, Soujanya Poria

VenueA*ACL
Year2024
ProceedingsACL (1)

Browse the full ACL paper archive.