Skip to content

NLSR: Neuron-Level Safety Realignment of Large Language Models Against Harmful Fine-Tuning.

Xin Yi, Shunfan Zheng, Linlin Wang, Gerard de Melo, Xiaoling Wang, Liang He

VenueA*AAAI
Year2025
ProceedingsAAAI

Browse the full AAAI paper archive.