CodeAttack: Revealing Safety Generalization Challenges of Large Language Models via Code Completion.
Qibing Ren, Chang Gao, Jing Shao, Junchi Yan, Xin Tan, Wai Lam, Lizhuang Ma
Browse the full ACL paper archive.
Qibing Ren, Chang Gao, Jing Shao, Junchi Yan, Xin Tan, Wai Lam, Lizhuang Ma
Browse the full ACL paper archive.