Skip to content

Defending Large Language Models Against Jailbreak Attacks via Layer-specific Editing.

Wei Zhao, Zhe Li, Yige Li, Ye Zhang, Jun Sun

VenueA*EMNLP
Year2024
ProceedingsEMNLP (Findings)

Browse the full EMNLP paper archive.