Skip to content

SafeMERGE: Preserving Safety Alignment in Fine-Tuned Large Language Models via Selective Layer-Wise Model Merging.

Aladin Djuhera, Swanand Ravindra Kadhe, Farhan Ahmed, Syed Zawad, Holger Boche

VenueA*ACL
Year2026
ProceedingsACL (Findings)

Browse the full ACL paper archive.