Skip to content

Defending Large Language Models Against Jailbreaking Attacks Through Goal Prioritization.

Zhexin Zhang, Junxiao Yang, Pei Ke, Fei Mi, Hongning Wang, Minlie Huang

VenueA*ACL
Year2024
ProceedingsACL (1)

Browse the full ACL paper archive.