Defensive Prompt Patch: A Robust and Generalizable Defense of Large Language Models against Jailbreak Attacks.
Chen Xiong, Xiangyu Qi, Pin-Yu Chen, Tsung-Yi Ho
Browse the full ACL paper archive.
Chen Xiong, Xiangyu Qi, Pin-Yu Chen, Tsung-Yi Ho
Browse the full ACL paper archive.