Skip to content

Stealthy and Persistent Unalignment on Large Language Models via Backdoor Injections.

Yuanpu Cao, Bochuan Cao, Jinghui Chen

VenueANAACL
Year2024
ProceedingsNAACL-HLT

Browse the full NAACL paper archive.